第 5 课 · 上下文窗口

AI 有"金鱼记忆"——但那个记忆窗口正在越变越大

比喻:AI 的"视野"

想象 AI 是一双眼睛,只能看到当前屏幕上显示的那一段文字。屏幕之外的内容,对它来说不存在。

这个"屏幕"就是 上下文窗口(Context Window)。

关键事实:每次你发新消息,AI 会重新读一遍整个"屏幕上"的所有内容(系统提示 + 历史对话 + 你的新消息),然后回复你。一旦超出窗口上限,最前面的内容就被截掉了——AI 从此"失忆"。

你的上下文窗口里塞了什么

系统提示
历史对话
当前
剩余空间
系统提示(CLAUDE.md) 历史对话(越多越占地方) 当前消息 剩余可用空间

这就是为什么聊太久会变贵——历史对话那部分一直在膨胀,每次请求都要重新传一遍。

各模型的"视野"有多大

4K
GPT-2 (2019)
已经淘汰
8K
GPT-3 早期
约一篇论文
128K
GPT-4 / DeepSeek
约一本小说
1M+
Gemini / Claude
约《三体》全书
模型上下文相当于
DeepSeek V4 Pro128K Token≈ 一本 200 页小说
Claude Opus 4.8200K Token≈ 一本 300 页书
Gemini 2.5 Pro1M Token≈ 整套《三体》

这对你有什么影响

窗口很大时

• 可以一次喂一整本小说
• 可以引用几百页文档
• 长对话不会"失忆"

但代价是

• 每次请求都传全量
• Token 消耗暴增
• 钱花得更快

这就是你听到的"上下文膨胀危机"的核心矛盾:
窗口越大 → 能记的越多 → 但每次请求越贵

实用的应对策略

1. 30 轮原则:对话到 30 轮左右,主动开新会话。用 `/resume` 恢复最近一次。

2. 精简 System Prompt:CLAUDE.md 别写太长,每条指令都问问自己"这条真的有必要吗?"

3. /compact 压缩:Claude Code 的 `/compact` 会把历史对话浓缩成摘要,减少上下文占用。

4. 一个任务一个会话:不要在同一个会话里做三件不相关的事。

这一课你带走的 3 个概念

1 上下文窗口 = AI 一次能看到的最大文字量,超出就"失忆"

2 DeepSeek V4 窗口 = 128K Token ≈ 一本 200 页小说

3 窗口虽大 ≠ 可以无节制聊 — 每次请求都传全量,对话越长越贵

Level 1 完成!返回课程首页