GPT-6 系列的速度,一夜之间提了一半。
这次更新由那位负责人自己在社交平台上宣布。
未来 28 天,他给自己定了一个计划。
每天要么上线一处看得见的改进。
要么干脆给所有人来一次重置。
第一天交的卷,是推理速度。
GPT-6 Astra 与 GPT-6.1 Sol 的默认生成速度,直接加了一半。

原本每秒 30 个词元,现在到了每秒 50 个。
覆盖范围不只是官方客户端。
OpenCode 与 Pi 这类第三方终端,也一并被串了进来。
这一代模型还换上了新的分词器。
同样一段长代码,底层消耗的词元更少了。
这类 AI工具 的一次提速,牵动的其实是一整条生态。

但速度只是故事的一半。
就在同一天,一份实测报告把另一本账摆上了台面。
在重度编程场景里,另一家的订阅能折出更多实际算力。
那点速度优势,并不足以让人从别处搬过来。

第一天先提速
那位负责人提前一天立下了目标。
接下来 28 天,每天都要有肉眼可见的改动。
做不到,就全量重置一次。


然后,第一天落在了速度上。
过去那个 30,被直接拉到了 50。
对做 AI编程 的人来说,速度就是生产力。

更关键的是覆盖。
不只是官方客户端,生态里的工具也跟着提速。
只要走订阅通道,一行代码都不用改。
官方的解释是,这次不只是并发上的调整。
底层分词器做了一次激进的更换。
同样一段长代码,消耗的词元总量被压得很低。
有效吞吐就这样被抬了起来。
换句话说,抬速靠的是少花词元,而不是多堆显卡。
不过开发者实测的体感,和官方说法有落差。
有人复核后表示,编程工具里的速度确实比 10 月 2 日快了约 1.5 倍。
换算成每秒词元数,只到 35 这个水平。
还有人的数字更低,说自己只能跑到 20 左右。
官方的口径是,得走接口通道才能摸到 50。
屏幕上的那点提升,因此没几个人真感觉到。
体感落差很明显。


订阅账被重算
有一家半导体研究机构买了双方的高价订阅。
用长时间的编程与智能体任务做压测,一直跑到每周上限。
再按公开的接口价格,把消耗折算成理论费用。

结果差得有点多。
200 美元这一档,ChatGPT Pro 的等效价值从约 14000 美元掉到约 2084 美元。
同一档的另一家旗舰方案,能折到约 11726 美元。
账算得很直白。
换句话说,差距超过五倍。
200 美元档,另一家的等效价值约为前者的 5.6 倍。
100 美元档是 5.4 倍。
20 美元档还是 5.6 倍。
对日常只用 AI对话 的人来说,这笔账没那么直观。
有人把两家的账单做成了收据样式的对比图,并排摆在同一张画面上。


更意外的是额度的调整。
就在上周,200 美元档的实际调用额度被砍掉了一半。
规则写得很细,从 10 月 30 日起,这一档包含的用量从 20 倍降到 10 倍。
要知道今年 6 月之前,这一档还能跑出接近 1.4 万美元的算力。


原因被拆在订阅数据里。
另一家的中档与高档套餐,用量到两成左右才勉强打平。
前者的两个主力套餐更紧,利用率过了一成一,公司就开始亏。
说白了,这类套餐赌的是大多数人用不满额度。
但智能体编程正在打破这个平衡。
多步骤、自主调工具的流程,词元消耗能到单轮对话的千倍级别。
机构还顺手算了另一笔账。
订阅业务吃掉了四成多的算力,却只贡献一成收入。
这笔账并不好看。

真正被这套账挤压的,是那些把额度当生产资料的团队。
四个入口合成一个
除了提速,还有一盘更大的棋。
有爆料说,OpenAI 打算把聊天、工作与编程几条产品线并进同一个入口。
这已经不只是界面层的合并。
背后是产品思路的转向。
转向幅度不小。

具体的变化有好几处。
模型选择器会被藏起来,推理过程也不再对用户展示。
往后你只需要说要做什么,不必关心它想了多久。
它生成的文本,还会被强制加一层隐形水印。
公告在同一天早上就放了出来,理由是要配合欧盟的监管要求。
公告里也承认,现有的文本水印技术还有明显局限。

商业化那头也在动。
等图像生成器出图时,用户会看到插入的广告。
聊天与工作两种模式预计合并,那个新入口的能力最终塞进主应用,覆盖 12 亿用户。
这笔账怎么算
提速与订阅价值,其实是一体两面。
跑得更快,意味着同样的额度能撑更久。
可单位算力的成本也在往上走,这才有了额度腰斩。
对普通用户来说,判断标准很简单。
若你只用它聊上几句,速度提升几乎感觉不到。
真正吃额度的是长时间跑任务的开发者,他们才需要重新算这笔账。
第一天交的卷是 50。
后面还剩 27 天。
