今早,一批开发者打开 Claude 网页端。
回答的味道不对。
界面右上角还写着 Fable 5.1。
可答话的方式全变了。

有人拿一句很普通的话去试。
你认识重置哥 Tibo 吗。
别搜索。

结果它没联网,也没调工具。
张口就把那位「重置哥」的来历讲清了。
拍下这一幕的,是知名爆料人 Chetaslua。
他说配图是模型自己改的,自己压根没提这个要求。
这类 AI工具 用久了,一点变化就能感觉到。

圈里有人直接表态。
5.1 和 5.5 的差距,大到不像同一代。
这不像打了个补丁。
像换了个人。
一句暗号,怎么分出两代
暗号里的 Tibo,本名 Thibault Sottiaux。
他管着 OpenAI 的编程助手 Codex。
Codex 出过故障,吃掉过用户额度。
他就在社交平台上宣布,给付费用户重置额度。
圈里人管他叫「义父」。

关键在于,新旧两代模型对这段记忆完全不同。
开发者 JAZIIO 晒出了一组对照。
走接口的原版 5.1,把 Tibo 认成了另一位法国开发者。
还说他的「重置」,是把事业推倒重来。
被路由进 Claude Code 的那版,却答出了额度重置。

标签还写着 5.1。
答出来的,却是只有新模型才记得的梗。
后台答题的,八成已经换了人。
宁可信一句暗号,也别只看界面上那行标签。

这句暗号不是今天才有。
9 月 18 日,有人就用它测出过一轮。
当时大家管那个神秘模型叫 5.2。
如今几条产品线都跳到了 5.5。
下一代 Fable 也只能是 5.5。
全网首测:不用教,它自己会
拿到疑似新模型的人,体感出奇一致。
不用教。
Chetaslua 说,不到 10 天前他灰测过这个版本。
只要一句话讲清要干什么,它就能把活干完。
细到每个小细节。

他还说,大部分任务不用写提示词。
连参考资料都不用给。
网友 can 晒出一个任天堂 GameCube 手柄。
这是第一个只用两句提示就画对的模型。
紫色机身,黄色摇杆,绿色按键,位置全对。
连底座那圈八角凹槽都没落下。

动画这块同样没拉下。
Chetaslua 做了一段超人变形的 3D 动画。
换一个场景,风格就换一套。


纯代码一把过,英雄角色全给搓了出来。

他没在提示词里扣任何细节。
形象全靠模型自己补全。

还有个 3D 像素风的网页,交互很顺。
世界七大奇迹,它一次就搭了出来。

一场对比测试里,它和对手的新旗舰各做一个交互水母。
拖拽回弹的手感,它明显强出一截。

也有人跑了经典的「鹈鹕骑自行车」。
开高思考,用代码画一段二维动画。
晒出的账单是 2.61 美元,跑了 4 分 6 秒。
按上一代每百万词元输入 10 美元、输出 50 美元的价,不算便宜。
预测市场上,押下一代输出价不低于 50 美元的一方,占了七成三。

聪明之外,它还得过自家兄弟那一关。
次一档版本发布时的定位就是,大多数任务做到上一代旗舰的水平。
成本却低了四成。

旗舰的本事,三周就下放到了次一档手里。
底牌是第一次全新预训练
那么,它凭什么跟自家次旗舰拉开差距。
爆料人给的答案是,这一代用上了全新的预训练。
这个阶段决定了模型的知识和天赋上限。
后面的强化学习,只是在这个底子上反复练。
参照很直观。
小一号的模型从 5 升到 5.5,终端测试成绩从 10.3% 窜到 70.6%。

只差最后一步
什么时候发,看过去两周的节奏就行。
被测模圈抓到痕迹之后,新版本都没让人等太久。

9 月 1 日发 5.1,9 月 23 日发次旗舰。
9 月 29 日发再次一档,最小的那个也已经官宣在路上。
如果下一代旗舰也在 10 月落地,这家的全系就在一个多月里换了一整轮。

另一边的日子就没这么顺。
9 月 29 日的开发者大会上,对手发的是另一个型号。
外界最期待的那个,没有露面。
有人提前一天就说过。
就看它发不发,不发接下来几周会打得非常吃力。

当然,这家也有软肋。
同样的活要烧掉多少词元,对手仍然占着上风。
暗号对上了,实测也刷屏了。
整个家族就差这临门一脚。
宁可等它正式露面,也别把传闻当成定论。
压力现在全给到了另一家。

Claude Code会员中转站 微信:douhanq
