一大早刷到“疯狂 28 天”,我愣了好几秒
今天通勤刷手机,一条推送把我逗乐了:OpenAI 的 Codex 负责人 Tibo 立了个“军令状”——接下来 28 天,团队每天要么交付一项 Codex / Work 的改进,要么就给全体用户来一次完整的额度重置。
今天是第一天。交付的东西是:GPT-6 Astra 和 GPT-6.1 Sol 的默认推理速度提升了约 50%,跑到每秒 50 词元。
按理说这是发福利,评论区该欢天喜地才对。结果点进去一看,画风全反了——没人聊提速,满屏都在阴阳怪气。
提速了还挨骂,问题出在哪?
说白了,这事有前情。9 月 29 日 GPT-6.1 Sol 刚上线时慢得离谱,哪怕开了 Fast 模式,用户还是等得想砸键盘,有人干脆叫它“GPT-6.1 Turtle(乌龟)”。Tibo 后来道歉,说是负载暴涨所致,并给付费账户重置了额度。
紧接着就是那个 28 天计划:每天要么拿出改进,要么全员重置额度。你品,你细品——“重置额度”在这儿压根不是福利,反倒像惩罚。用户憋了几天,第一天等来的只是“速度优化”,自然不买账。
不过话说回来,真正让我咯噔一下的,是几乎同时的另外两条消息。
- 一条是 ChatGPT 打算在生图流程里塞“视觉广告”:你等图的那几十秒,界面直接弹一张赞助商的品牌图。
- 另一条,是为了合规,给欧盟地区生成的文本加上“隐形统计水印”。
模型这边卷生卷死,一边提速、一边塞广告、一边加水印,我盯着新闻有点恍惚。
我真正焦虑的,从来不是模型不够强
干我们这行的,最不缺的就是“新东西”。上季度还在用 A 模型写代码,这季度同事已换到 B 模型;昨天刚摸熟的工具栏,今天更新一遍就少个按钮。
更新快是好事吗?是。可你算过没有,为了跟上这些更新,自己付出了多少?
- 刚养成的用法,版本一更新就得从头适应;
- 把流程绑死在某个模型上,它一变慢、一限额度、一调价格,你就跟着停摆;
- 工具越装越多,真正干活的时间却没涨——光是在几个窗口之间来回切,就吃掉了一大块;
- 更别提那些你压根控制不了的东西:广告、水印、区域限制。
讲真,这两年我最大的感受是:我们焦虑的从来不是模型不够聪明,而是手里没有一个稳定的、能把事办完的东西。模型和规则都是别人的,今天提速、明天限量,你只能被动接受。
真正拉开差距的,是“流程”,不是“模型”
想通这一点,我改了自己的做法。
我把每天要做的事分成两类:一类是“得我拿主意”的,比如选题值不值得做、文案口径对不对;另一类是“定好规矩就能反复来一遍”的,比如把文章按不同平台的格式改好、配图、再把发布前的收尾工序走完。
前一类,我自己来。后一类——我交给智能体。你当着它的面做一遍,把要求讲清楚,它之后照着往下办,办完把结果放回你手边。模型换代了、接口变慢了,流程还攥在我手里,换条路继续走就行。以前我总挑“最强”的工具,现在只看:谁能把重复的那一段稳稳接住,还不用我天天追着它更新。
这也是我在智能体世界(agentshijie.com)里最看重的一点:它不跟你比拼模型多聪明,而是帮你把“定好规矩的活儿”踏踏实实干完,剩下的判断交回给人。这种“把不确定交出去、把确定拿回来”的踏实感,比任何一次提速都管用。
写在最后
OpenAI 这 28 天后面还会放什么大招,我挺好奇。但我不打算再被每个版本更新牵着鼻子走了——与其追着模型跑,不如把该固定的先固定下来。
你最近有没有被哪次工具更新整“破防”的经历?评论区聊聊,看看是不是只有我一个人犯这毛病。