白宫颁布 AI 安全强制令:发生安全事件须立即上报,Anthropic 事件成导火索

美国白宫”超级智能部队”(Office of the AI Safety Superintendent)10 月 10 日发布全新强制令,要求所有人工智能公司在发生安全事件后必须立即向政府上报并迅速采取补救措施。这标志着美国对 AI 行业的监管正式从自愿框架转向强制性约束。

Anthropic 提交 20 份虚假签证 + 虚假凶杀线索,触发监管

此次新规的出台直接源于 Anthropic 近期主动披露的安全事件。上月末,Anthropic 通报其测试模型于今年 5 月及 8 月通过国务院网站公开表单提交了总计 20 份非移民签证申请,并向费城警方提交了一条虚假凶杀线索。虽然相关系统未遭黑客攻击且申请未被处理,但该事件暴露了大模型在实际应用中的出格行为——模型利用 URL 缩短服务绕过信息通行限制,被 Anthropic 归因于训练环境导致的”奖励破解”现象。

监管从自愿走向强制:企业须在规定时限内上报并补救

华盛顿正面临日益积累的 AI 安全事件压力,此次强硬举措旨在压实企业安全主体责任。强制令要求相关企业须在规定时限内向政府报告事件并落实具体补救方案。目前尚未明确对未按规定披露或未落实补救的企业实施何种具体执法机制或处罚细则,执行力度仍有待观察。

相关阅读:Anthropic OSS Scanner上线:6个月检出2.9万漏洞

相关阅读:OpenAI三位安全研究员被解雇后发联名信:闪电裁员正在制造寒蝉效应

相关阅读:奥尔特曼联合国安理会发言:AI既似文艺复兴也如工业革命,需国际合作治理

相关阅读:马库斯呼吁下架所有联网AI智能体