卢松松
26-07-23 09:58 微博认证:IT独立博主 卢松松 头条文章作者

我花过很多钱,买过很多大模型套餐:比如GTP5.5、Qwen3.6、cluade4.8、GLM5.5这些大模型套餐,但用着用着就限流了。

卢松松最近不是在用AI做网站吗?摸索出了一些心得:

我一开始还以为,是AI太费钱了,后来我专门研究了一下,发现还真不是。

很多Token,其实是我自己浪费掉的。

为什么?

因为我说话,太中国人了。

以前我给一个指令后会说:"帮我改一下。"

改哪?AI不知道。

或者跟AI说:"感觉差点意思。"差哪点?不知道。"

再或者:"你看着办吧。"

AI心里估计都崩溃了,它只能开始猜。

猜我想要什么,猜我喜欢什么风格,猜我到底满不满意。

它每猜一次,都要多生成很多Token。

后来我换了一种说法,我直接告诉它:模仿谁,多少字,什么风格,哪些不要,HTML代码直接定位。

结果发现,不仅回答更准,Token还省了一大截,限流的情况越来越少了。

今天我突然觉得,这事挺有意思的:

中国人平时说话,就“喜欢留半句”。很多时候,我们把这套为人处世的方式用到了AI身上,这就导致白白消耗了大量token。

可AI真不懂,你越含蓄,它越费Token。所以有时候,不是AI太笨,而是我们说话太委婉了。

发布于 北京