美国地方媒体集体起诉微软与OpenAI:数万篇版权文章被用于大模型训练,一分钱没赔

以密西西比州埃默里奇报业集团为首,多家美国地方新闻机构近日向法院递交诉状,指控微软和OpenAI长期、系统性地在没有授权、没有支付任何补偿的情况下,把数以万计受版权保护的新闻文章用于大模型训练,并借此赚取巨额商业价值,而原创内容提供者却连一分钱都没见到。

版权管理信息被一并抹除

诉状中最具技术细节的一笔落在版权标识上。原告指出,涉案文章里原本嵌着作者署名、出版机构名称、版权声明、使用条款等版权管理信息,这些等于作品的”身份证”。原告指控微软和OpenAI在把内容投进训练之前,把这些标识一并抹掉。此外,原告声称,其新闻内容在过去几年里多次被AI系统以近乎逐字重复的方式输出,这反过来证明那些材料早已被深度咽进了模型。

地方媒体:这是”丧钟”

对美国地方报纸来说,这不只是版权账,更是生存账。美国地方报纸这些年本就扛着纸质销量下滑、广告萎缩的双重压力,而AI能直接把答案递到用户面前,进一步抽走本就变薄的流量。原告方因此把科技公司的做法称为”地方新闻业的丧钟”。除埃默里奇报业集团外,Ojai Media及Coopwood旗下多家出版与媒体公司也参与联名起诉。

双标指控:保护己方代码却用他人内容

诉状还点出一处鲜明的双标:微软和OpenAI一边被指无视出版商的版权,一边却积极用许可协议、付费服务和法律手段把自己的代码、模型、系统护得严严实实。原告还特意翻出旧账:OpenAI曾公开抱怨竞争对手拿它生成的内容去训练模型、损害自身利益——这番姿态和它此刻被指控的行为恰好形成对照。原告要求法院判赔损失与补偿,并强制两家公司从模型训练数据里删除所有涉及原告版权作品的内容。

相关阅读:美国议员提最严AI监管法案:递归自我改进被禁

补充:原告换成了社区报

这桩官司并非孤例,《纽约时报》等大型媒体此前已以相同理由起诉微软和 OpenAI。这次的新增量在原告构成:联名方 Ojai Media 与 Coopwood 旗下多为独立报纸和杂志出版商,诉状援引《数字千年版权法案》指控版权管理信息被抹除。