新媒体矩阵

Anthropic披露26%的AI研发由Claude主导

Anthropic发布三项AI发展速度指标,截至8月26%的AI研发由Claude主导,约3万个智能体常驻内部平台。

Anthropic于9月18日在官网发布《理解前沿实验室中AI发展速度的衡量指标》,首次向外界公开三项内部指标,给"AI参与AI研发"的程度提供量化刻度。

研发自动化程度排在首位,截至8月,Anthropic约26%的AI研发工作由Claude主导,"主导"指模型能从一条高层指令出发完成大部分任务,人类主要承担审查与批准,这一比例在今年3月仅为1%。超过90%的研发工作有AI深度参与,但没有任何环节实现完全自主运作。

image.png

智能体监督是第二项指标。在其最常用的内部平台上,任意时刻约有3万个AI智能体在执行研发与工程任务,8月产生超过10亿次决策。智能体的全部动作100%经过在线监控系统,被拦截的比例为0.002%,约合每4.7万次动作拦截一次。

算力分配构成第三项指标,投向AI研发的算力中约6%用于安全研究。

这份文件的背景是Anthropic CEO阿莫迪9月12日的长文《We Must Pace the Frontier》。他在文中呼吁前沿实验室为AI发展定速,把递归式自我改进列为需要全球协调限速的对象,并单方面承诺引入拥有员工级权限的独立第三方评估员进驻公司。Anthropic表示,公布这些数据是为了帮助公众了解世界距离递归式自我改进还有多远,一旦跨过这一临界点,AI系统将更难被理解和控制。公司同时计划让外部评估者获得与内部风险团队相当的系统访问权限。

头部实验室把"AI造AI"的进度摆上台面,此前多停留在论文与表态层面,这次给出了可复现的测量方法,研发自动化指数、智能体监督与算力分配三项指标把研发过程拆到了可对照的颗粒度。测量口径仍有争议,26%的"主导"评级部分依赖Claude自行判定,但指标框架一旦公开,同行跟进披露与外部审计就有了对照的基准。

ScreenShot_2026-09-05_133120_912.png

评论 0