长对话最烧额度,换个用法省四成

你是不是也习惯把一个用得顺手的 AI 对话置顶,之后所有活儿都在里面接着聊?How-To Geek 的作者 Patrick Campanale 这么干了一年半,结果差点被迫把每月 100 美元的套餐升到 200 美元。

原因藏在一个容易被忽略的机制里:每次发消息,系统并不是只把这一句话送给模型,而是把整段对话历史一起打包送过去,好让模型知道你说的「这个」到底指什么。对话越长,每次消耗的词元就越多,额度自然掉得越快。更麻烦的是,会话大到一定程度,平台会自动压缩摘要,一旦压得不准,回答就开始跑偏。

他的解法是把长对话「固化」成技能(可复用的固定指令包)。关键一步是别自己动手写——直接让工具读完那段长对话,自己总结成一个技能文件;以后每次都在全新会话里调用它,送出去的只有必要指令。作者说,改用这种方式之后词元用量降了三到四成,套餐不用升了。

说白了,长对话给人的「连贯感」是错觉,真正稳定输出的是那套固定指令。为一致性付的钱,其实一直花在反复运输旧内容上。这也解释了一个常见困惑:为什么用得越久,同一个对话反而越不听话。

建议照着做一次:翻出你用得最顺的那个长对话,让 AI 把它整理成一个技能,凡是要做第二遍的事都这么处理。你手上有哪个流程最值得先固化下来?

来源:How-To Geek,作者 Patrick Campanale,2026 年 8 月 3 日