开发者 Lyra 这两天翻出一个内测代号,claude-wafer-eap。代号背后站着的模型,是 Claude Opus 5.5。
按她拿到的时间表,最快这周二就会放出来。
所有人的预期原本停在 5.2。结果版本号直接跨过去,落到了 5.5。

这张推文截图就是最早的爆料来源。截图里的原话说得很直白。这家公司正在秘密测试新版本,计划周二发布。
盯这条线的开发者不止一个。有人把新旧版本的对撞缩成了一句话。

5.5 大于 6。这句话里的 6,指的是 GPT-6。
更微妙的一条来自另一头。有开发者提到,Astra 可能已经打乱了这家公司的上市计划。

一家准备上市的公司,如果对手先扔出旗舰模型,投资人问的第一个问题就会很难回答。所以它手里必须也有新东西。
于是就有了这张写着周二见的预告图。

Lyra 后来补了一句更具体的。新版本现在就能打败 gpt-6-sol。

口气不小。对天天调接口的人来说,这类消息最后都会变成 AI工具 账单上的数字。
不过后面陆续流出的实测,让这话至少不太像吹牛。
中间的 5.2 去哪了
今年的节奏本来是这样的。7 月 24 日 Claude Opus 5 正式发布。之后短暂出现过一个 5.2 的测试版本。
按常规做法,下一步该是 5.2 转正。可这次直接把 5.2 跳了过去,一步跨到 5.5。
这不是常规迭代。它更像在赶一个很窄的时间窗。
最先上手的一批人里,有个叫 Harshith 的开发者。他让新版本做了一个 Waymo 无人车的三维模型。

结果连捷豹的车标和车顶那颗激光雷达都还原了出来。这些小细节平时最容易被模型糊过去。
他还贴了账单。同一个模型任务,按旧价要 50.56 美元,按泄露的新价只要 27.39 美元。

图上另一组数字更直观。输入只有 1.4k,输出却有 532k。缓存的读取量是 4120 万,写入量 170 万。
换句话说,这条模型线被当成了长任务的干活工具。它不再是那种一问一答的聊天框。
另一位开发者 Veee 换了个方向。他让新版本基于 Three.js 写了一个网页端的三维汽车展示器。

渲染质量和交互都挺扎实。这已经接近一个能直接交付给客户的页面。
价格往下砍,缓存单价最狠
跟版本号一起流出的,还有一张定价表。目前都没有得到官方确认。

按流传的版本,新的输入价是每百万词元 4 美元,输出价 20 美元。缓存读取 0.2 美元,缓存写入 5 美元。
把它和现役的 Opus 5 摆在一起,差距就清楚了。

输入从 5 美元降到 4 美元,输出从 25 美元降到 20 美元。降幅大约两成。
真正狠的是缓存读取。单价从 0.5 美元掉到了 0.2 美元。
这个数字意味着什么。一个跑长上下文的智能体,每一步都要反复读同一段上下文。缓存单价砍掉一半多,整体开销就跟着掉一个量级。
这才是企业敢把顶配模型放进日常流程的前提。
Fable 5.2 这条线也在动
这家公司手里不止一张牌。Opus 之外,Fable 这条线同时有了新动静。
开发者 Pankaj Kumar 拿到了一张早鸟票。他说官方似乎正在把 Fable 5.1 的流量悄悄切到 5.2 上。

他的评价相当高。5.2 的三维生成能力追平了 Astra,有些地方还反超了。而且不需要写很细的提示词,它就能猜到你要什么。
他试着搭了一个悬崖边的别墅场景。

打光、材质反射和氛围感都挑不出毛病。
它还能一把生成完整的小游戏。

另一位开发者 Chetaslua 的测试更极端。没给素材,没开任何插件,也没画草图。

新版本纯靠原生 JavaScript 写出了一个微缩世界。

画面里那只 Claude 吉祥物,连同身后的整个世界,全是一行行代码画出来的。
还有网友搭出了一个能跑能动的小型网页系统。几十种头部建模、面部微表情和交互控件,都在一次生成里跑起来了。

最后是一组正面对决。同样是渲染一个海岸场景,两款模型的产出摆在一起,差别一眼就能看出来。

一边用新版本稳住企业级的基础设施,一边用 Fable 5.2 抓住创意和前端。这套组合拳的节奏卡得很准。
三家挤在同一条赛道上
大模型圈子这周的节奏,被彻底带快了。
三家公司的步调罕见地撞在一起。而且撞的是同一个战场。
三条技术路线摊开看,各自的算盘都很清楚。

OpenAI 这边,GPT-6 Astra 把科学推理和模型智力的上限又抬了一截。代价是推理开销太高。
普通工程师的日常任务用不起这样的模型。它更像一把供起来的刀。
所以圈子里更期待的,是从接口里被扒出来的 GPT-6 Sol。

按流传的说法,它同样定在周二,能力接近 Astra,成本低得多。有人把它看成开发者真正会天天用的那一版。
ChatGPT 身后的 OpenAI 抢的是这个位置。
Anthropic 的反差最有意思。就在上周,掌门人 Dario Amodei 还在长文里呼吁行业降速。

话音没落,自家的 Opus 5.2 就被扔进了回收站。跳级,降价,抢跑。三件事在同一个版本里做完。
原因也不难猜。上市之前需要一个能重新稳住信心的重磅模型。抢在对手的开发者大会之前,把开发者的预算份额拿回来。
谷歌那边也等不下去了。Gemini 3.5 Pro 的进化幅度被内部判为不及预期,发布直接取消。
Gemini 4 Pro 于是成了唯一的指望。在竞技场的实测里,它用 gemini-3.8-flash 这个代号出现,各项指标压得很狠。

Logan Kilpatrick 说,这会是谷歌迄今为止规模最大的预训练项目,目标是让谷歌回到巅峰。
把这些碎片拼起来,结论并不复杂。这一刀既砍向对手,也砍向自己的上市焦虑。

至于这一局最后谁赢,这周的发布会就是答案。
