上礼拜,老周给我发微信。一张账单截图,配了三个字:看不懂。

他给一个AI接口充了一百块,四天下来,只剩十几块。

他自己算过账:我一天就打几十个字,怎么比打电话还贵。

我说,你要真是按字算,这钱花得一点都不冤。可惜它不按字算。

它按Token算。

一堆硬币旁边摆着几块彩色小积木
一堆硬币旁边摆着几块彩色小积木

Token是啥?你就当它是"被切碎的字"

一句话递给AI,它不是整句吞下去的。

它先拿把刀,把句子切成一小块一小块。每一小块,叫一个Token。

英文里,常见的单词大概占一块。apple 是一块,unbelievable 可能被切成三块。

中文更细。一个汉字通常占一块,有些生僻字占两块。标点、空格、换行,一样算钱。你随手打的那个"嗯",它也照收。

老周那天说,我就发了"帮我改改这段文案",十来个字。

他忘了后面还跟着一整段原文。两千多字。那两千多字,全是钱。

一把小刀正在切开一条长纸带
一把小刀正在切开一条长纸带

为什么非要搞个Token,直接按字不行吗

模型不认字。它认的是数字。

每个Token都有个编号,模型真正看到的是一串数字。把字切成Token,就是为了让它好算。

所以按Token收费和按字收费,中间隔着一层翻译。

这层翻译,就是钱多钱少的地方。

一本翻开的字典旁边放着数字键盘
一本翻开的字典旁边放着数字键盘

计费表上那两栏,藏着大差别

打开任何一家的价格页,你都会看到两栏。

一栏叫输入Token,一栏叫输出Token。

输入是你发给它的,输出是它回给你的。输出那栏的价,通常是输入的2到4倍。

翻译一下:让它少说两句,比让你少打两句更省钱。

价格一般按"每百万Token"标。一百万Token是什么概念?差不多能装下三四本畅销书。

听着挺多,用起来很快。一篇两千字的公众号文章,从头到尾过一遍,就是两千多个Token。

两块并排的标价牌
两块并排的标价牌

最坑的一条:它每回都要把老账重算一遍

这件事知道的人不多。

你跟AI聊十轮,它不是只记着第十轮。

前面九轮说过的、答过的,每一轮都要重新读一遍,重新算一次钱。

所以你聊得越久,账单越厚。

一条越拉越长的线
一条越拉越长的线

老周后来跟我复盘了他那个工具。

他每次都要把一份三百行的需求文档塞进去,然后问一句"这里帮我改一下"。

三百行文档,大概四千个Token。他那一句问话,二十个Token。

四千对二十。烧钱的是那份文档。他那句话,几乎可以忽略。

而他连着问了二十多遍。同一份文档,也被算了二十多遍。

一只打开的钱包
一只打开的钱包

我自己在用的几招,都是实打实省下来的

第一招,把话攒着一次说完。

想改三段,就一次把三段和你的要求一起发过去。

别一句一句喂。来回拉扯十次,等于重算十次。

一个人一次性把一叠纸递过去
一个人一次性把一叠纸递过去

第二招,长材料别反复贴。

现在大部分平台都有缓存。同一个开头重复出现,第二次会便宜不少。

但你要是每次都手动复制粘贴,还带着前面的对话一起发,这个折扣就享不到。

固定要用的长文档,做成文件上传,或者单独开个固定开头。别每回重打一遍。

第三招,管住它的嘴。

你要结论,就直接说"三句话说完,别解释"。

你写"详细展开,不少于两千字",那两千字就是你自己的钱。

老周现在每次都补一句"答案控制在100字以内"。他说光这一句,一个月省了三十多块。

一个被拧小的水龙头
一个被拧小的水龙头

第四招,简单活儿别上大模型。

改错别字、调格式、翻译短句,小模型干得挺好,价格能差好几倍。

真需要动脑子的活儿,再换大的。

说白了,AI不是按字收钱,是按"它得读多少"收钱

它每一次都要把你的上下文从头读一遍。

你付的钱,买的是它每一次重新理解你的功夫。

想通这件事,很多莫名其妙的账单就看懂了。

你贴的每一段长文档、每一轮没必要的来回,都在悄悄往上加价。

我现在养成一个习惯。

开一段新对话之前,先停三秒,想清楚两件事:这次到底要它干什么,材料能不能只给一份。

想清楚再打字,比打完再心疼划算。

你有没有被AI账单吓到过?

我第一次看到"输入Token""输出Token"分两栏计费,还以为系统算错了。后来才知道,人家写得清清楚楚,是我自己没看。