OpenAI 与 Microsoft 内部文件承认:他们正在制造一场摧毁内容供给链的「末日循环」
“OpenAI and Microsoft knew they were starting a ‘doom loop’ for the web”
NYT诉OpenAI与Microsoft案新解封的92页法庭文件显示,两家公司内部早就清楚自己在做什么。Microsoft应用科学总监Brent Hecht在内部把训练数据的抓取称为「人类历史上最大的劳动盗窃」,并称公司的fair use抗辩「完全是对『合理使用』这一概念的嘲弄」。一份Microsoft内部文档直言:「我们的AI内容策略已经启动了一个『末日循环』,它将同时损害我们模型的表现和整个网络——一个终端产品威胁其关键供应商的经济基础,这极不寻常,但这就是我们为LLM业务与其『内容供应链』所创造的处境。」Satya Nadella在宣誓作证时承认,与聊天机器人对话已经「替代了……直接在网站上获取信息、而不必访问原始来源」。OpenAI方面同样知情:ChatGPT负责人称出版商面临「生存威胁」,这些产品「基本上是替代性的,而且随着模型变强会越来越具替代性」;政策总监Jack Clark写道公司正在「创造替代那些定义社会『文化』的人之劳动的系统」;内部文档把ChatGPT称为「现代报刊亭」。OpenAI员工2022年6月就承认GPT-4「记住了大量数据,因此极其擅长原样复述」,而公司代表作证称不知道有任何检测或移除付费墙内容的努力——尽管Nadella说过「任何有付费墙的内容都应该获得授权」。OpenAI联合创始人Greg Brockman则写道,他被商业化OpenAI技术可能带来的「天文数字」收益「深深激励」。OpenAI自己的经济与媒体专家还把NYT等站点推荐流量下滑归因于Google AI Overviews等AI摘要,估计搜索推荐量最多下降60%,Google Discover的月度推荐从50亿次以上降到不足40亿次,Search从30亿次以上降到略高于20亿次。Microsoft发言人回应称Hecht的言论只代表个人观点,不代表公司立场,并称Nadella的证词谈的是人们获取信息方式的广泛变化,不应与版权结论混淆。
- Microsoft内部文档承认AI内容策略已启动「末日循环」,同时损害模型表现和整个网络。
- Microsoft高管把训练数据抓取称为「人类历史上最大的劳动盗窃」,并称fair use抗辩是对该概念的嘲弄。
- Nadella宣誓承认聊天机器人已替代用户访问原始网站的行为。
- OpenAI内部承认GPT-4「极其擅长原样复述」,且无人负责检测或移除付费墙内容。
- OpenAI自己的专家把出版商推荐流量下滑归因于Google AI Overviews等AI摘要,估计搜索推荐最多下降60%。
- 文章几乎完全站在NYT与出版商一侧,未讨论AI摘要是否也创造了新的信息获取效率与新的内容需求。
- 未涉及出版商可能通过授权协议、付费墙技术或反爬机制获得的新议价空间。
- 未讨论若AI训练被严格限制,小型模型与开源生态可能受到的挤压。
- 做AI产品的人需要重新评估「内容供给」这一环的合规与商业风险:内部文档一旦进入诉讼,「我们不知道」这类抗辩基本失效,数据来源审计要提前做
- 做内容平台或依赖搜索/推荐流量的团队,应把Google AI Overviews带来的20%-60%推荐下滑当作结构性变量,而不是短期波动,提前设计不依赖搜索引流的用户触达路径
- 对投资与战略判断而言,「LLM是摧毁自身供应链的产品」这一自认,意味着模型厂商未来必须为内容支付更高成本或自建内容,这会改变AI公司的毛利结构与竞争格局