Anthropic 公开内部研发账本:Claude 已主导 26% 的核心研发

Anthropic 第一次把内部的研发账本摊开了。

报告里有三个数字。Claude 已经能自主主导 26% 的核心研发工作。内部平台上常年跑着约 3 万个研发智能体。用于安全研究的算力,只占整体的 6%。

Epoch AI 六级自动化评分表

这三个数字指向同一个词。递归自我改进,也就是让 AI 参与研发下一代 AI,一代比一代快。

这个说法在业界争了很多年。争论的焦点是一件事,AI 能不能独立写出比自己更强的模型。

这家公司给的答案不是表态,而是一组量出来的结果。他们借用了外部机构 Epoch AI 的六级自动化标准。这套标准从完全人工的 AL0 级起步,一直排到 AI 完全闭环的 AL5 级。自家研发流水线被逐段对照了一遍。

Anthropic 官方发布的三项指标说明

为了让数据站得住,他们在 2026 年 7 月做了一次随机抽样。范围是模型研发部门 20% 的员工。一个 Claude 研究智能体翻完了这些人的内部聊天记录。

它最后整理出 1.5 万项研发任务,归成 542 个任务节点。

Claude 已经主导 26% 的研发

截至 2026 年 8 月,还没有任何一个子任务完全脱离人类。

但渗透率已经很高。第一个数字是 26%。这个比例指的是它能自主主导的核心研发工作。人类工程师只给一个宏观目标。剩下的端到端流程,由模型自己跑完。

AI 自动化等级阶梯图

第二个数字是 90%。这是达到或者超过人机深度协同的工作占比。换句话说,这家公司超过九成的核心模型研发流程,已经离不开模型。

工程师的位置在往后撤。撤到提需求的那一层。

研发任务按自动化等级分档的月度占比
研发任务被拆解成六个环节

26% 变成 50%,再变成 100% 会怎样,报告没有正面回答。它只是把这条曲线摆在读者面前。

3 万个智能体在内部平台上班

第三个数字更直接。

报告披露,在这家公司最常用的内部平台上,日常并发运行着约 3 万个研发智能体。

它们不休息,也不领工资。全天候写代码,互相派活。

问题也跟着来。3 万个高智商的程序在半自主地做长周期工作。怎么保证它们不越界。怎么保证模型权重不被偷偷传到外网。

为此他们搭了一套双层监控。

在线监控与离线监控的分工

第一层是在线拦截。这些智能体敲下的每一行代码,在执行前几秒都会被扫一遍。

8 月他们追踪了超过 10 亿次智能体决策。阻断警报的占比是 0.002%。换算下来,大约每 4.7 万次操作就有一次被叫停。

一个月里被强行暂停的越界操作,接近 2 万次。

第二层是离线复核。系统每周纳入全部行为记录,先做多层分类和筛查。筛完之后剩下约 10 万份可疑日志。优先级最高的 50 起事件,最后交给人来审。

除了监控,还有两条防走样的设计。

一条是独立身份。每个智能体都有单独的身份标签和记忆记录,这个身份还不跟着底层模型版本走。模型升级了,它还是它。

另一条是取消私聊。所有智能体都在同一条公共总线上沟通,消息可追溯,彼此之间还能互相纠错。

安全研究只拿到 6% 的算力

看一家公司是不是真在乎安全,可以看它的算力怎么分。

这家公司把账本也公开了。它调出 2026 年 7 月 13 日到 7 月 20 日这一周的算力快照。分类的活交给了 Claude。近 1 万次运行记录被逐条抽样,核心大额任务再单独加权。

结果看起来并不好看。整体研发算力里,只有约 6% 划给了安全研究。方向包括对齐研究,可解释性研究,还有安全红蓝对抗。在由模型主导的那部分算力里,这个比例略高,约 12%。

安全研究在研发算力中的占比

它自己的解释是,安全研究和能力训练是两套逻辑。训练前沿模型要成千上万张高端显卡,是个吞噬算力的无底洞。安全研究更像是人类研究员在设计实验。他们解剖模型内部的回路,耗的是脑力,不是算力。

他们还强调这是保守估计。只要一个算力任务既能提升能力又能帮上安全,就一律不算进安全额度。

公开这个难看的数字,其实是另一种打法。算力是这些指标里最容易被量化和核实的一项。宁可把难看的数字摆出来,也不留一个自己说了算的口径。

把标准交出去

这份报告表面上是一次内部审计。实际上,它更像一封公开的挑战书。

报告结尾写得很直白。当世界在考虑如何控制前沿模型的发展速度时,前沿实验室应该尽一切可能。把自己知道的,和公众知道的,拉近一点。

任何前沿开发者都可以发布同样的衡量标准,交给第三方验证。

报告结尾的结论

这一招的狠处在于,它把是否公开变成了一块试金石。

过去各家都在黑箱里做研发,公众只看到跑分。现在这个箱子被撬开了一角。第三方评估机构也开始进场。

如果其他几家跟进,整个行业的透明度会被抬上去。如果不跟进,那就是另一种回答。

第三方研究员的评价

自我改进的飞轮已经在转。3 万个不休息的智能体,正在从一个工具变成一个群体。它们写出的代码,正在被用来写下一版自己。

想自己动手试试这类工具,可以从站内的 AI工具 分类看起。

写代码那部分更直接,AI编程 这个入口就够了。