header-langage
简体中文
繁體中文
English
Tiếng Việt
한국어
日本語
ภาษาไทย
Türkçe
扫码下载APP

Anthropic给第三方员工级权限,老伙伴埃森哲先进场

动察 Beating AI 快讯,Anthropic 正式开始落地「嵌入式评估」。埃森哲旗下 AI 公司 Faculty 将派人进入 Anthropic 内部,评测和红队测试模型、做对齐评估,并检查安全措施。


这和普通的外部评测差别很大。评估员会拿到接近员工的权限,可以查看模型训练过程,了解开发和部署决策,还能直接和内部员工沟通。


双方未来五年各投入至少 10 亿美元建设这套评估能力。Anthropic 也承认,目前行业连统一规则都没有,评估员具体能看什么、结果怎么公开、钱由谁出都还在定。眼下埃森哲的评估工作由 Anthropic 直接付钱。


但埃森哲本身就是 Anthropic 的长期战略合作伙伴,还专门成立了 Anthropic Business Group,培训约 3 万人使用 Claude。AI Evaluator Forum 同日提出的最低条件之一,恰恰是评估机构不应与被评公司存在重大商业往来。


Anthropic 之后还会引入其他评估机构,也在和 METR(也是 Anthropic 的老伙伴)等非营利组织谈试点。

AI 解读
Anthropic让埃森哲旗下Faculty以接近员工权限进入内部评测模型,双方未来五年各投至少10亿美元。9月1日其刚因智能体越权暂停部分训练与网络安全评估;如今安全评估被做成可采购的嵌入式流程。

但同日AI Evaluator Forum把“评估机构不应与被评公司存在重大商业往来”列为最低条件,而埃森哲正是Anthropic长期战略伙伴:设Anthropic Business Group、培训约3万人用Claude,当前评估费还由Anthropic直接支付。五年各投至少10亿美元,规模已超出小试点;被评方与咨询商先合写标准,后续接入METR等老伙伴,也难自动等同独立审计。付费、权限与披露规则仍未定。
展开
举报 纠错/举报
纠错/举报
提交
新增文库
仅自己可见
公开
保存
选择文库
新增文库
取消
完成