第 3 课 · Token 是什么

AI 不认识"汉字",它把文字切成小块,每个小块就是一个 Token

AI 读文字之前,先"切碎"

你写:"我喜欢学习AI"

AI 实际看到的是:

我 喜欢 学习 AI

这句话 = 4 个 Token

Token 规则(大概):
• 1 个常见汉字 ≈ 1~2 Token
• 1 个英文单词 ≈ 1~2 Token
• 1 个标点/空格 ≈ 1 Token
• 1 个生僻字可能 ≈ 3~4 Token
• 1000 Token ≈ 750 个中文字,或 750 个英文单词

Token = 钱

DeepSeek 就是按 Token 数来收费的。每次对话,你花的 Token 分两块:

Input(输入)

你发给 AI 的所有文字
+ 系统提示词
+ 历史对话

¥0.001 / 1K Token

DeepSeek 缓存命中时 ¥0.0001

Output(输出)

AI 回复你的所有文字
+ 代码
+ 工具调用结果

¥0.002 / 1K Token

输出比输入贵一倍

这是 DeepSeek 官网定价,2026年7月。不同模型价格不同。

算一笔真实的账

你现在这一次对话,大概消耗多少 Token?

系统提示词(CLAUDE.md 等) ~4,000 Token
你这几轮对话(输入) ~3,000 Token
我的回复(输出) ~8,000 Token
项目数量单价费用
输入 Token7,000¥0.001/1K¥0.007
输出 Token8,000¥0.002/1K¥0.016
合计≈ ¥0.023
这次对话 ≈ 2 分钱
(但上下文膨胀后一次请求可能 90 万 Token,那就 ¥2.7 一次了)

为什么聊越久,越烧钱?

每次你发新消息,AI 都要重新读一遍整个对话历史。这就是你 CLAUDE.md 里说的"上下文膨胀":

第 1 轮:发送 500 Token → 收到 300 Token → 共 800
第 5 轮:发送 2000 Token(含前面所有对话)→ 共 5,000
第 20 轮:发送 30,000 Token(含前面所有对话)→ 共 80,000
第 50 轮:发送 120,000 Token(含前面所有对话)→ 共 350,000

这就是为什么 CLAUDE.md 里写了"30 轮后要开新会话"——不是因为 AI 累了,是因为你的钱包在流血。

这一课你带走的 3 个概念

1 Token = AI 阅读文本的最小单位,不是"字"也不是"词"

2 1000 Token ≈ 750 汉字,输入 ¥0.001,输出 ¥0.002(DeepSeek 价格)

3 对话越长越贵 — 因为每次请求都带上整个历史,Token 数滚雪球

下一课:Prompt 提示词 · 你跟 AI 说话的方式