AI 公司一直主张,拿新闻训练模型是在创造新东西,并非替代原作。但新公开的内部材料显示,两家公司员工早已担心另一种结果:AI 越好用,读者越可能不再访问或付费阅读原媒体,最终连模型赖以学习的优质内容也会枯竭。
据《纽约时报》报道,9月17日解封的诉讼材料中,一份 Microsoft 2023年内部文件称,大模型吸收全球创作者劳动可能构成空前规模的“劳动盗窃”,并警告出版业受损会形成降低未来训练数据质量的“doom loop”。OpenAI 的 Nick Turley 同年称 AI 对出版商构成“生存威胁”,2024年又写道,产品能力越强,替代性也会越高。Satya Nadella 则在证词中表示,付费墙后的内容应获得许可;若得知 OpenAI 用这类内容训练,他会要求重新训练模型。
这些文件成为出版商主张市场受损的重要内部证据。不过,开封不等于法院已经采信。OpenAI 和 Microsoft 仍主张训练属于 fair use(合理使用),产品并非原作替代品;Microsoft 也称相关备忘录不代表公司立场。法官目前正审理简易判决动议,即判断案件能否不经完整庭审便裁定部分或全部争议。