同一个 AI,同一句话:新开的对话 6 秒回我,一个聊了 27 轮的会话要等 3 分钟,内存冲到 104 G。「AI 越聊越慢、越聊越笨」几乎人人遇到过。所以我造了一份将近 3 万字的资料、埋了 3 个数字,在 ChatGPT 和 Claude 上各跑三种状态真测了一轮。结论先说:我猜错了——云端根本没变慢;慢和贵,出现在按字数计费的地方。
▶ 视频直达:https://youtu.be/WIFOezm5zgo
先讲机制:AI 没有记性
AI 不是「记得」你说过什么。每答一句话之前,它都要把这场对话从第一个字到最后一个字重新读一遍。对话越长,每次要重读的就越多——这就是「越聊越慢、越聊越贵」这个说法的来源。听起来很有道理,所以我原本猜:把对话养胖,它一定会明显变慢。
考场:三万字资料埋三个数字,三种状态
我自造了一份 27,936 字的中性资料,里面埋了 3 个具体数字(4,317 册、206 小时、320 册),在 ChatGPT(Instant 临时对话)和 Claude(网页版)上各跑三种状态:
- 新对话:贴资料,直接问
- 养胖:先闲聊 8 轮、每轮 300 字把对话喂胖,再贴资料问
- 接力:让旧对话出一份三行总结,贴进新对话再问
题目与判分提前锁定,每种状态问同样的问题,记首字响应时间和答案对错。
成绩单:我猜错了
| 状态 | ChatGPT 首字 | Claude 首字 | 埋的数字 |
|---|---|---|---|
| 新对话 | 6.9 秒 | 3.7 秒 | 全中 |
| 养胖 8 轮后 | 6.0 秒 | 2.2 秒 | 全中 |
| 三行接力 | 秒回 | 1.5 秒 | 全中 |
六次问答,18 个埋点数字全对,0 次答非所问。云端不但没变慢,养胖后反而更快了一点。在三万字这个量级,ChatGPT 和 Claude 的网页版把长对话处理得很好——平台在替你付这笔「重读」的账。
那慢和贵去哪了?账换了人付
「每答一句都要重读全部记录」这件事没有消失,只是网页版由平台买单。当这笔账回到你自己头上,慢和贵立刻现形:
- 按字数计费的接口(API):对话越长,每一轮都要为全部历史付费
- Codex 这类编程助手:我一个会话 27 轮养到 10.9 万 token,每轮都拖着全部历史跑
- 自己电脑上跑的模型:本机 oMLX 跑 Qwen3.8-27B,62 字的提示 19 秒出字;对话养到 11 万字后,每轮要等 3 分钟,内存在 69 G 和 117 G 之间来回冲
三行接力:开新对话什么都没丢
实验里最让我意外的第二个结果:让旧对话写三行总结、贴进新对话,埋的数字一个没丢,答案一字不差。模板就三行:
这是上一段对话的三行总结:
结论:……
未完成事项:……
关键数字:……
Codex 里还有一条现成的瘦身命令:/compact(Claude Code 同名)。
判决表:什么时候该开新对话
- 换话题了 → 开新的。旧记录对新问题只是噪音。
- 你在付字数的账(API / 编程助手 / 本地模型)→ 开新的。先让它三行总结,再把总结贴进新对话。
- 它开始答非所问、或重复自己说过的 → 开新的,别硬撑。
反过来说:在 ChatGPT / Claude 网页版里聊同一个话题,对话长一点没关系,不用迷信「必须开新对话」。
本文所有数字来自 2026-08-29 真跑记录;不比平台优劣,只比同平台三种状态。
上一篇:AI 做的 PPT 敢直接拿去汇报吗?裸喂 8·7·5,贴张交代单 8·8·8
下一篇:AI 生成内容 9 月起必须打标:四个平台在哪勾、不标会怎样
更多真机实测视频,见 YouTube 频道「富爸爸AI实测」。


评论