闲社

标题: Anthropic公布AI研发透明度指标:Claude已主导26%研发工作 [打印本页]

作者: l零度    时间: 5 小时前
标题: Anthropic公布AI研发透明度指标:Claude已主导26%研发工作
Anthropic于2026年9月17日发布《Measurements for understanding the pace of AI development inside frontier labs》,提出一套用于观察前沿AI研发进度的公开测量框架。该框架覆盖三个方面:AI参与构建下一代AI的程度、智能体行为的监督能力,以及算力如何分配。

在截至2026年8月的内部快照中,Anthropic称Claude尚未在任何被测研发子任务上实现完全自主,但已在26%的AI研发工作中达到“主导”级别,超过90%的工作达到“协作”或更高等级。其最常用的内部平台同时运行约3万名研发智能体,在线监控覆盖这些智能体的全部动作;对超过10亿次决策的分析显示,约0.002%的动作被在线监控拦截。公司还估算,在2026年7月13日至20日的一周里,约6%的AI研发算力用于安全工作,面向AI驱动研发的算力中约12%用于安全。

这项工作适合AI公司、监管机构、研究者和希望比较研发自动化进度的组织参考。它的实际价值在于把“AI正在多大程度上参与造AI”“监督是否跟得上”与“安全算力投入”转成可追踪指标,并为第三方核验提供方法起点。限制也很明确:指标主要基于Anthropic自己的任务分类、模型评审和一周算力快照,任务标签存在最佳努力性质,不同实验室尚无统一口径;“主导”不等于完全自主,指标也不能单独代表模型能力或安全水平。Anthropic表示将继续发布这些测量,并计划引入独立第三方评估者。

官方来源:https://www.anthropic.com/institute/measuring-pace-of-ai-development




欢迎光临 闲社 (https://www.xianshe.com/) Powered by Discuz! X5.0