ChatGPT、Claude 越聊越慢越笨?同一句话新对话 6 秒、养胖后 6 秒:我猜错了——什么时候该开新对话

fubaba AI工具评论91阅读模式
摘要

造 3 万字资料埋 3 个数字实测:云端根本没变慢,慢和贵出现在按字数计费的地方。附「什么时候该开新对话」判决表。

同一个 AI,同一句话:新开的对话 6 秒回我,一个聊了 27 轮的会话要等 3 分钟,内存冲到 104 G。「AI 越聊越慢、越聊越笨」几乎人人遇到过。所以我造了一份将近 3 万字的资料、埋了 3 个数字,在 ChatGPT 和 Claude 上各跑三种状态真测了一轮。结论先说:我猜错了——云端根本没变慢;慢和贵,出现在按字数计费的地方。

▶ 视频直达:https://youtu.be/WIFOezm5zgo

先讲机制:AI 没有记性

AI 不是「记得」你说过什么。每答一句话之前,它都要把这场对话从第一个字到最后一个字重新读一遍。对话越长,每次要重读的就越多——这就是「越聊越慢、越聊越贵」这个说法的来源。听起来很有道理,所以我原本猜:把对话养胖,它一定会明显变慢。

考场:三万字资料埋三个数字,三种状态

我自造了一份 27,936 字的中性资料,里面埋了 3 个具体数字(4,317 册、206 小时、320 册),在 ChatGPT(Instant 临时对话)和 Claude(网页版)上各跑三种状态:

  • 新对话:贴资料,直接问
  • 养胖:先闲聊 8 轮、每轮 300 字把对话喂胖,再贴资料问
  • 接力:让旧对话出一份三行总结,贴进新对话再问

题目与判分提前锁定,每种状态问同样的问题,记首字响应时间和答案对错。

成绩单:我猜错了

状态 ChatGPT 首字 Claude 首字 埋的数字
新对话 6.9 秒 3.7 秒 全中
养胖 8 轮后 6.0 秒 2.2 秒 全中
三行接力 秒回 1.5 秒 全中

六次问答,18 个埋点数字全对,0 次答非所问。云端不但没变慢,养胖后反而更快了一点。在三万字这个量级,ChatGPT 和 Claude 的网页版把长对话处理得很好——平台在替你付这笔「重读」的账。

那慢和贵去哪了?账换了人付

「每答一句都要重读全部记录」这件事没有消失,只是网页版由平台买单。当这笔账回到你自己头上,慢和贵立刻现形:

  • 按字数计费的接口(API):对话越长,每一轮都要为全部历史付费
  • Codex 这类编程助手:我一个会话 27 轮养到 10.9 万 token,每轮都拖着全部历史跑
  • 自己电脑上跑的模型:本机 oMLX 跑 Qwen3.8-27B,62 字的提示 19 秒出字;对话养到 11 万字后,每轮要等 3 分钟,内存在 69 G 和 117 G 之间来回冲

三行接力:开新对话什么都没丢

实验里最让我意外的第二个结果:让旧对话写三行总结、贴进新对话,埋的数字一个没丢,答案一字不差。模板就三行:

这是上一段对话的三行总结:
结论:……
未完成事项:……
关键数字:……

Codex 里还有一条现成的瘦身命令:/compact(Claude Code 同名)。

判决表:什么时候该开新对话

  1. 换话题了 → 开新的。旧记录对新问题只是噪音。
  2. 你在付字数的账(API / 编程助手 / 本地模型)→ 开新的。先让它三行总结,再把总结贴进新对话。
  3. 它开始答非所问、或重复自己说过的 → 开新的,别硬撑。

反过来说:在 ChatGPT / Claude 网页版里聊同一个话题,对话长一点没关系,不用迷信「必须开新对话」。

本文所有数字来自 2026-08-29 真跑记录;不比平台优劣,只比同平台三种状态。

上一篇:AI 做的 PPT 敢直接拿去汇报吗?裸喂 8·7·5,贴张交代单 8·8·8

下一篇:AI 生成内容 9 月起必须打标:四个平台在哪勾、不标会怎样

更多真机实测视频,见 YouTube 频道「富爸爸AI实测」。

文章末尾固定信息
weinxin
我的微信
微信扫一扫
fubaba
  • 本文由 发表于 2026年8月31日 13:45:08
  • 转载请务必保留本文链接:https://www.fubaba.org/133.html
评论  0  访客  0
匿名

发表评论

匿名网友

:?: :razz: :sad: :evil: :!: :smile: :oops: :grin: :eek: :shock: :???: :cool: :lol: :mad: :twisted: :roll: :wink: :idea: :arrow: :neutral: :cry: :mrgreen: