《纽约时报》诉微软与OpenAI版权诉讼案最新解密的法庭文件,撕下了生成式AI行业维系两年的体面假面。未涂黑的动议备忘录显示,两家公司的高管在私下通信与宣誓证词中,将大语言模型的训练直接定性为人类历史上最大规模的劳动盗窃,并清晰指认自身商业策略正在制造一场拖垮整个互联网内容供给的自毁循环。

这不仅是司法取证层面的失守,更坐实了科技垄断者心知肚明的生态悖论:大模型并未创造出新的价值分配体系,它一边靠侵吞人类原创劳动完成冷启动,一边以零点击答案阻断源头活水,最终将把自身赖以进化的数据地基推向塌陷。

法庭内外:生成式AI的言行分裂 法务公开抗辩(合理使用) · 训练属于受版权法保护的转换性学习 · 仅提取语言抽象规律与事实信息 · 偶发吐出原文纯属极个别技术瑕疵 内部解密证词(供应链自毁) · 承认建立在人类史上前所未有的盗窃上 · 专门研发黑客工具强行绕过媒体付费墙 · 摧毁上游内容供应链,形成自毁循环

内部证言剥落合理使用外衣

在过去的公开诉讼中,OpenAI与微软始终将自身置于合理使用(Fair Use)的保护伞下,强调模型仅如人类阅读般学习语言规律。然而解密文件展现出全然相反的内部认知。微软高管Brent Hecht直言,大语言模型掠夺内容却无法向下游供应链分配经济价值,这必然危及创作者的生存根基;OpenAI政策总监Jack Clark亦承认,公司所构建的系统正在全面替代定义社会文化的劳动者。

更具毁灭性的是对主观恶意的举证。诉讼披露OpenAI内部曾专门开发工具绕过纽约时报的付费墙抓取全文,联合创始人Greg Brockman对此的内部回复是轻松的“ah, nice”。而在分发端,微软CEO萨提亚·纳德拉等人在宣誓作证时承认,在将抓取的新闻聚合进生成结果后,Bing流向新闻网站的点击量暴跌超过90%。一位OpenAI工程师在证词中道出了零点击搜索的冷酷事实:无论系统把源链接摆得多显眼,用户根本不会点。

这种内部清醒与外部抵赖,瓦解了合理使用抗辩中最关键的要素——未对原作品潜在市场造成实质替代。科技巨头明知大模型是在吸干内容供应商的血脉,却依然按下了规模扩张的快进键。

终极产品直接扼杀了核心供应商的经济基础,这是大模型工业亲手设下的自毁死局。
被切断的动脉:AI搜索对Web生态的抽血效应 -90% Bing对新闻网站导流跌幅 高管作证承认的实际流失率 194 : 1 AI搜索极端爬取引流比 Perplexity每爬近两百次仅带一访 -60% 小型出版商两年流量骤降 Chartbeat实测传统搜索流失

流量塌陷印证三十年契约破裂

万维网三十年来的繁荣建立在抓取与导流的默契之上:爬虫索取内容索引权,搜索引擎通过超链接将流量反哺给站点以维持广告或订阅变现。然而,大模型把索引篡改为答案,彻底单向化了这场交换。

来自独立机构的多维度数据印证了这场失血有多严重。Pew Research在2025年3月的测试表明,出现AI Overview的搜索结果中,仅有8%的用户点击了传统网页,对比没有AI模块时的15%近乎腰斩;更致命的是,仅有1%的用户会点开AI综述内部附带的信源链接,超过四分之一的用户在看完提炼后直接终止了浏览行为。

这种结构性衰竭在上游出版行业形成了不对称绞杀。Chartbeat在2026年7月的数据显示,Google流向出版商的搜索流量同比下降34%,其中大型出版商两年内传统搜索引流下降22%,中型下降47%,而议价能力最弱的小型出版商流量断崖式暴跌60%。虽然Google官方公布截至2026年6月其AI Overview月活已突破25亿、AI Mode月活超10亿,并宣称总体有机点击保持稳定,却从未公布支撑其结论的底层数据集。

与此同时,AI厂商对基础设施的掠夺变本加厉。Cloudflare在2025年的网络监测发现,传统Google的爬取与引流比维持在3:1到30:1之间,而新兴AI搜索引擎Perplexity的抓取与引流比一度突破700:1,即便到2025年7月仍高达194:1。生成式AI向媒体导流的能力虽然在放大——Similarweb数据显示2025年初ChatGPT流向新闻媒体的访问暴涨约25倍突破2500万次,但这一体量在传统搜索渠道动辄数以亿计的失血缺口面前,不过杯水车薪。


赎买少数与阻隔多数的技术困局

面对合法性崩塌,OpenAI试图通过双边采买建立护城河。截至2025年1月,该公司已与美联社、新闻集团、英国金融时报、华盛顿邮报等近20家主流媒体机构签署授权协议,网络覆盖超过160家媒体与数百个品牌。但这种商业割席反而加剧了公地悲剧:头部媒体凭借庞大体量拿走安抚金,而数以百万计的垂直博客、中小独立网站不仅分不到分文,反而在零点击搜索中被榨干剩余价值。

内容防线正在被迫技术化。Cloudflare在2026年9月15日推出了细分拦截工具Disallow AI Training,将网页爬取明确切分为搜索索引(Search)、模型训练(Training)与实时代理(Agent)三类,尽管微软、苹果与Google均已承诺遵守该分流标准,但中小创作者依旧陷入允许爬取失去点击、禁止爬取彻底隐形的生存囚徒困境。

  • 风险.若法庭据此驳回微软与OpenAI的合理使用抗辩并启动实质赔偿,大模型厂商必须重构以API或授权计费的内容回流机制;否则人类高保真语料供给将在两年内枯竭,基础模型升级将被迫充斥合成垃圾数据。

这场诉讼不仅剥夺了科技巨头站在道德高地上的特权,也宣布了依靠无偿侵占全网数据构筑千亿估值的时代走向终结。当宿主被寄生者彻底吸干,所谓的超级智能终将失去进化的阶梯。