Anthropic 五年投 10 亿美元做外部安全评估

Anthropic 把外部评估的活交给了埃森哲。埃森哲的 Faculty 团队会进场做模型评测、红队测试、对齐评估与防护测试,双方计划五年各投入至少 10 亿美元建设 AI 安全能力。

争议点在钱从哪来

评估费用由 Anthropic 自己支付。这一点让独立性打了折扣,自己出钱请人评估自己,结论能有多硬,没人说得清。

消息里还提到,埃森哲要核查 Anthropic 是否履行自身的安全承诺。这部分如果真做起来,倒比单纯的模型评测更有看点,因为查承诺比查模型更接近实质。

五年各 10 亿美元是什么量级

双方对等投入这个安排值得留意。它不是常见的甲方乙方关系,而是两边同时出钱。这种结构至少说明,安全能力建设在这两家眼里已经不是单纯的合规支出。

常见问题

谁来监督埃森哲

素材里没有给出第三方监督机制。评估方由被评估方付费,这个结构本身就意味着外部审计仍缺一环。

这件事影响谁

短期看是 Anthropic 的合规动作。长期看,如果这套外部评估范式被其他厂商跟进,AI 安全评估可能会变成一项独立的产业。

小结

把安全评估外包出去是进步,但付费方和受益方重叠的问题不解决,独立性始终是个问号。这条消息的真正价值,或许在于它把一个长期被回避的问题摆上了台面。

相关阅读

这条线上还有几篇站内文章可以接着看: