Context_Window
2026/7/23小于 1 分钟
长短期记忆:上下文窗口 (Context Window)
你之前调过的 16000 窗口大小,本质上是 AI 的 “工作内存”。
- Token (令牌):AI 不按字数收费,按 Token。你可以理解为“语义碎片”。
- KV Cache (键值缓存):这是 2026 年大模型推理优化的核心。当对话变长时,AI 会把之前的对话“压缩”成一种特殊的缓存。如果缓存满了,它就会“失忆”。
- 运维技巧:在 AIOps 中,日志文件往往很大。如果直接把 10MB 的日志塞进窗口,AI 会直接“爆内存”或者变傻。聪明的做法是先用 Shell 过滤出
error行,再喂给 AI。
