Anthropic 把外部评估的活交给了埃森哲。埃森哲的 Faculty 团队会进场做模型评测、红队测试、对齐评估与防护测试,双方计划五年各投入至少 10 亿美元建设 AI 安全能力。
争议点在钱从哪来
评估费用由 Anthropic 自己支付。这一点让独立性打了折扣,自己出钱请人评估自己,结论能有多硬,没人说得清。
消息里还提到,埃森哲要核查 Anthropic 是否履行自身的安全承诺。这部分如果真做起来,倒比单纯的模型评测更有看点,因为查承诺比查模型更接近实质。
五年各 10 亿美元是什么量级
双方对等投入这个安排值得留意。它不是常见的甲方乙方关系,而是两边同时出钱。这种结构至少说明,安全能力建设在这两家眼里已经不是单纯的合规支出。
常见问题
谁来监督埃森哲
素材里没有给出第三方监督机制。评估方由被评估方付费,这个结构本身就意味着外部审计仍缺一环。
这件事影响谁
短期看是 Anthropic 的合规动作。长期看,如果这套外部评估范式被其他厂商跟进,AI 安全评估可能会变成一项独立的产业。
小结
把安全评估外包出去是进步,但付费方和受益方重叠的问题不解决,独立性始终是个问号。这条消息的真正价值,或许在于它把一个长期被回避的问题摆上了台面。
相关阅读
这条线上还有几篇站内文章可以接着看:
