十月九日早上,阿宁照常打开 Gemini,想把昨晚三小时的会议录音丢进去,让它整理成纪要。

输入框还在。他贴完文字,点了发送。

回来的东西短了一截。以前会给到七八条待办,这次只给了三条,还漏掉了老板说的周五前必须交的那个方案。

他翻回设置里看,默认模型变了。

他关掉了页面。

阿宁二十六岁,在一家二十来人的小公司做运营。写周报、翻英文邮件、把会议录音压成要点,这半年基本都交给免费版 Gemini。

他跟我说,它还是能用,只是得自己再补一遍。

那天下午,他手动重写了四十分钟。

一张摆着电脑的办公桌
一张摆着电脑的办公桌

谷歌把免费那一档,换了更轻的模型

十月三日,谷歌 Gemini 应用帮助中心挂出了一条变更说明。

从今年十月九日起,用个人账号访问 Gemini 的免费用户,不再默认拿到完整的 Flash 模型,Pro 模型的入口也收了回去,统一换成更小、更轻的 Flash-Lite。

付了 AI Plus 的人,也不再提供 Pro 访问。谷歌说会给这批订阅用户发邮件,逐一说清变化从哪天算起。

各档位拿到的东西,现在是这样:没订阅的只有 Flash-Lite;AI Plus 有 Flash-Lite 和 Flash;AI Pro 和 AI Ultra 才是三档都齐。

地铁车厢里
地铁车厢里

变轻,到底轻掉了什么

模型换成轻量版,最直接的差别在几件事上。

长文字处理更容易被截断,多步骤的活儿容易半路跑偏,代码和复杂推理的深度也会掉一档。

对只想问两句天气、改个标题的人来说,这些差别可能感觉不到。对天天拿它啃长文档、写分析、调代码的人,差别就是实打实的返工。

阿宁那种用法,正好卡在后面这一类。

客户名单里有一半是海外客户,时差摆在那儿,能赶的时间窗口就那么几个小时;他以前习惯把整段沟通记录丢进去让模型先出一稿,再自己改,现在这一步得拆开做,先让它划出重点,再自己一段段补。

拆开做。

一张堆满东西的桌子
一张堆满东西的桌子

免费的东西,正在一笔一笔收回去

这半年,用免费 AI 干活的人多了一大批。工具也养出了一批习惯,早上先让它列待办,晚上让它改稿子。

等到用顺手了,档位就动了。

这两年类似的调整还有不少。有的把高峰时段的推理速度压下来,有的把长文档的上下文砍短,有的干脆把免费出口挪到一个更难找的页面。平台的说法通常也很客气,用技术升级或者体验优化带过去,很少有人会直接把降级两个字写进公告。

谷歌这次的调整并不孤单。算力很贵,每一次推理调用都要真金白银,免费额度对平台来说,本来就是一笔要算清楚的账。至于账怎么算,做 AI 的公司心里都有数。

够用就行。

真正难受的是那些已经把工作流搭在上面的人。换一个工具,意味着重新熟悉界面、重新判断它靠不靠谱,这些成本加起来,比多花的那点订阅费高得多。所以大多数人不会走,只会一边抱怨,一边把活儿拆得更细,自己多干一点。

阿宁也是这样。

他后来跟同事聊过这件事。同事说自己也遇到过,某个下午开始,模型回答变得又短又快,翻半天设置才看出是档位调整。两个人算了一下,公司里用免费 AI 干活的还有五六个,没人收到过通知,也没人真去读那封邮件,因为邮件是英文的,写得又长又绕。阿宁说他现在养成一个习惯,每次要它做正经事之前,先随便问一句长的,看看回答够不够细,再决定这活儿要不要交给它。

桌上摊开的笔记本和笔
桌上摊开的笔记本和笔

顺带说一句,这条变更对国内用户影响有限,很多人用的入口本来就不一样。被它挡住的,是那些把免费版当成主力工具的人。

一排排的档案柜
一排排的档案柜

还能做什么

第一件,先看自己常用的入口是哪一档。同一个名字下的产品,档位不一样,拿到的东西能差出一截。

第二件,把重要的活儿分清楚。要它读长文档、做多步分析的时候,尽量放在还有完整模型的时段和入口上,别等它截断了才发现。

第三件,给关键结论留个复核的步骤。轻量模型答得快,稳不稳是另一回事,自己过一遍最省事。

第四件,如果这工具已经成了你每天的刚需,要不要为它付钱,就变成一道该认真算的题。按月费算,再按你省下的时间算。

夜里亮着灯的写字楼
夜里亮着灯的写字楼

阿宁后来没升级。他把写周报的活儿拆成了两步,先自己列好要点,再让模型润色。

慢是慢了一点,他说,至少不会被它漏掉老板那句话。

你每天离不开的那个 AI 工具,是免费的还是付过钱的。