9月18日,Anthropic公布一组用于衡量前沿AI实验室研发进度的新指标,首次披露公司内部AI参与AI研发的情况。数据显示,截至2026年8月,Claude已经能够“主导”Anthropic约26%的AI研发工作,同时超过90%的相关工作已经达到AI参与协作的程度。
这意味着,AI正在从传统的“辅助研发工具”,进一步进入模型训练、评估、工程和研究等核心环节。不过,Anthropic同时强调,目前没有任何被测量的AI研发工作达到完全自主的阶段。
Claude已经参与下一代AI的研发
Anthropic此次建立了一套AI研发自动化指数,将AI参与程度划分为AL0至AL5六个等级。
其中,AL3代表AI能够在人的密切指导下完成较大部分工作;AL4则意味着AI可以根据较高层级的指令,独立完成一项任务的大部分流程,由人类进行监督;AL5则代表完全自主运行。
截至8月,Claude在Anthropic内部AI研发工作中的“主导”比例已经达到26%,而达到“AI协作”及以上水平的工作比例超过90%。
3万个AI Agent同时参与研发
图片来源于网络
除了自动化程度,Anthropic还首次披露了内部Agent的使用规模。
数据显示,截至2026年8月,其最常用的内部平台上,大约有3万个AI Agent同时承担研究和工程工作。这些Agent的行为会经过线上和线下监控,其中线上监控覆盖了这些Agent的全部行动。
Anthropic表示,公司在2026年8月分析了超过10亿次研究与工程Agent决策,其中约0.002%的行动被线上监控系统拦截。
AI开始参与造AI,但距离完全自主仍有距离
Anthropic此次公布的数据,也让“AI研发AI”从一个抽象概念变成了可以持续追踪的指标。
不过,从目前数据来看,AI参与研发与完全自主的递归自我改进仍然是两个不同阶段。Anthropic明确表示,截至2026年8月,Claude还没有在任何被测量的AI研发工作中实现完全自主运行。
与此同时,Anthropic还披露,在其抽样统计的一周内,约6%的AI研发算力被用于安全相关工作;用于AI驱动AI研发的算力中,安全研究占比约12%。
这次披露的意义或许并不只是一个“26%”的数字,而是前沿AI公司开始尝试把AI究竟参与了多少AI研发、Agent如何被监管以及算力如何分配,变成可以持续公开追踪的数据。