闲社

标题: Anthropic与埃森哲启动嵌入式AI评估合作:把独立评估员带进前沿实验室 [打印本页]

作者: guodongxiong    时间: 8 小时前
标题: Anthropic与埃森哲启动嵌入式AI评估合作:把独立评估员带进前沿实验室
事件概述:Anthropic于2026年9月18日宣布与埃森哲旗下Faculty开展非独家合作,试点“嵌入式评估”(embedded evaluation),让独立评估人员在模型训练、构建和部署过程中进入公司内部观察与评估。

对象与发布方:项目面向前沿AI系统,由Anthropic发起,Accenture的专业AI业务Faculty负责牵头执行。

官方发布日期:2026年9月18日。

关键安排:合作范围包括模型评测与红队测试、对齐评估、模型安全措施测试;双方预计未来五年各投入至少10亿美元建设相关能力。评估员将获得接近员工级别的访问权限,可以跟踪模型形成过程、了解关键构建与部署决策,并直接与员工沟通。

适用对象:关注前沿模型安全、治理、红队测试和企业AI部署的研究人员、企业安全团队与政策制定者。

实际影响:如果落实,评估员可更早发现训练和部署盲点,并为外界提供更可验证的安全承诺信息;这也把AI安全评估从发布前或发布后的外部审查,推进到开发过程中的持续监督。

限制与待解决问题:官方明确表示目前尚无统一的访问范围、报告标准和独立评估资金机制;嵌入式评估不会转移Anthropic对模型安全的责任,具体执行方式仍在试点和演进中。

官方来源:Anthropic《Partnering with Accenture on embedded evaluation》
https://www.anthropic.com/news/accenture-embedded-evaluation




欢迎光临 闲社 (https://www.xianshe.com/) Powered by Discuz! X5.0