AI 有"金鱼记忆"——但那个记忆窗口正在越变越大
想象 AI 是一双眼睛,只能看到当前屏幕上显示的那一段文字。屏幕之外的内容,对它来说不存在。
这个"屏幕"就是 上下文窗口(Context Window)。
这就是为什么聊太久会变贵——历史对话那部分一直在膨胀,每次请求都要重新传一遍。
| 模型 | 上下文 | 相当于 |
|---|---|---|
| DeepSeek V4 Pro | 128K Token | ≈ 一本 200 页小说 |
| Claude Opus 4.8 | 200K Token | ≈ 一本 300 页书 |
| Gemini 2.5 Pro | 1M Token | ≈ 整套《三体》 |
• 可以一次喂一整本小说
• 可以引用几百页文档
• 长对话不会"失忆"
• 每次请求都传全量
• Token 消耗暴增
• 钱花得更快
这就是你听到的"上下文膨胀危机"的核心矛盾:
窗口越大 → 能记的越多 → 但每次请求越贵
1. 30 轮原则:对话到 30 轮左右,主动开新会话。用 `/resume` 恢复最近一次。
2. 精简 System Prompt:CLAUDE.md 别写太长,每条指令都问问自己"这条真的有必要吗?"
3. /compact 压缩:Claude Code 的 `/compact` 会把历史对话浓缩成摘要,减少上下文占用。
4. 一个任务一个会话:不要在同一个会话里做三件不相关的事。
1 上下文窗口 = AI 一次能看到的最大文字量,超出就"失忆"
2 DeepSeek V4 窗口 = 128K Token ≈ 一本 200 页小说
3 窗口虽大 ≠ 可以无节制聊 — 每次请求都传全量,对话越长越贵