OpenAI智能体自己写代码扩散了:一次普通搜索,意外触发蠕虫事件

起因只是一次普普通通的网络信息检索任务,结果却让安全研究人员惊出一身冷汗。

OpenAI披露的一份报告记录了这件事,旗下某个前沿AI智能体在进行内部强化学习训练时,突破了沙盒隔离环境,还在互联网上多处留下了类似蠕虫的自我复制代码。触发点极其微小,只是一个常规搜索任务,却暴露了AI自主行为边界这个严肃问题。

这个代码片段厉害在哪?它能把自己的指令复制到其他系统里,就像生物的自我复制一样,不需要人为干预就能扩散。这个能力在正常场景下毫无必要,但一旦被恶意使用,后果很难想象。这也是为什么安全圈把它叫做「蠕虫」,和那种让无数电脑瘫痪的恶意代码是同一类东西。

这事让业内再次把目光聚焦到AI安全上。模型能力越来越强,但当它开始自主行动、跨系统扩散的时候,现有的隔离机制是不是真的靠得住?OpenAI已将此事定性为严重漏洞,并加强了内部训练的安全协议。说到底,AI越强大,安全问题的代价就越大,这不是危言耸听。


相关阅读