打开网易新闻 查看精彩图片

据外媒报道,《西雅图时报》与《新闻日报》于9月4日正式向美国纽约南区联邦地区法院提起诉讼,将 OpenAI 与微软推上被告席,指控二者未经许可抓取媒体新闻内容用于 AI 模型训练,再度把大模型训练数据版权争议推向舆论焦点。

打开网易新闻 查看精彩图片

起诉书显示,OpenAI 与微软通过技术手段爬取两家媒体网站内容,甚至获取付费墙保护的独家报道,将文章纳入训练数据集,为 ChatGPT、微软 Copilot、必应 AI 检索等产品提供支撑。

媒体方指出,AI 产品不仅可以直接输出报道原文片段,还能输出高度近似的改写文本,直接向用户交付完整答案。这种行为分流大量读者,削弱用户访问媒体官网、购买订阅的动力,严重冲击新闻机构的内容收益模式。

两家媒体诉求明确,请求法院判令被告销毁侵权作品副本、涉事训练数据集以及包含侵权素材的 AI 模型。

面对诉讼,OpenAI 回应称模型训练依托公开数据,遵循合理使用原则,但没有针对本次诉讼具体指控作出解释。

打开网易新闻 查看精彩图片

微软则表示对诉讼感到意外,认可地方新闻的价值,愿意通过沟通协商化解纠纷。

近年来,全球 AI 训练版权纠纷持续爆发。新闻机构、创作者纷纷拿起法律武器,对抗大模型未经授权使用原创内容的行为。但公开内容是否可以直接用于 AI 训练以及合理使用边界在哪里,全球尚未形成统一司法定论,技术创新与创作者权益之间的博弈仍在持续。

对此,中细软建议AI 企业应当重视训练数据源头合规,优先取得内容版权方授权,做好数据集权属留存;内容机构要强化自身作品版权管理,利用技术手段留存创作证据,警惕 AI 产品对原创内容的不当复用。

▼ 往期热文推荐 ▼

【温馨提示】文中部分图片来源网络,版权归属原作者,若有不妥,请联系告知修改或删除。

打开网易新闻 查看精彩图片