大模型厂商在法庭外宣讲合理使用,法庭内解密的内部通信却掀开了另一面。2026年9月17日,《纽约时报》等新闻出版机构诉微软与 OpenAI 案解密了一份长达92页的联合简易判决备忘录。这批原本被两家公司要求严格保密的内部文件,把硅谷技术叙事撕开了一道口子:巨头高管私下不仅深知抓取新闻的破坏性,甚至直接将其定性为掠夺。

微软应用科学总监 Brent Hecht 在内部多次发出警告,直言抓取新闻训练 AI 是人类历史上最大规模的劳动力盗窃,并指出这种做法让版权法中的合理使用原则沦为嘲弄。而在 OpenAI 内部,ChatGPT 负责人 Nick Turley 同样承认生成式产品对出版商构成了生存威胁,因为商业化聊天机器人的功能本质上是替代性的。公开场合的法律抗辩与私下信件的清醒判断,形成了极其刺眼的割裂。

致命自认击穿了合理使用防线

美国版权法第107条界定合理使用,核心锚点从来不是技术有多先进,而是行为是否具备转换性,以及是否实质替代了原作品的潜在市场。过去数年,微软与 OpenAI 始终将 Google 图书案当作护身符,辩称模型抓取公开网页只是为了学习统计规律,属于合法的转换性使用。但解密文件表明,他们内部很清楚自己的产品不是引流索引,而是直接提供替代品

文件披露,当 OpenAI 员工向联合创始人 Greg Brockman 汇报找到绕过《纽约时报》付费墙的黑客手段时,后者的回复只有一句轻描淡写的“Ah, nice”。更具法律杀伤力的是高管证词:微软 CEO 萨提亚·纳德拉在宣誓作证时承认,AI 平台直接在界面上给出答案,实质上就是在抢夺新闻网站点击;纳德拉甚至表示,若知晓模型使用了绕过付费墙的数据,他本可以要求 OpenAI 重新训练模型。一旦替代性与恶意规避被管理层在书面上坐实,原告直接击中了合理使用抗辩的最软处。

公开抗辩与法庭解密口径对照 公开诉讼防御策略 · 援引 Google 图书判例 · 坚称抓取属于学习统计规律 · 主张摘要具备高度转换性 · 强调 AI 具备长期反哺潜力 法庭解密内部定性 · 内部直指“人类最大劳动力盗窃” · 承认“本质上完全是替代品” · 绕过付费墙被内部视作技巧 · 监测到部分原告点击暴跌超 90%

面对这些落入卷宗的言论,微软官方辩称 Brent Hecht 的观点仅代表个人视角而非公司立场,纳德拉的表态也是泛指信息消费趋势。然而当内部邮件详细记录着部分新闻原告点击率出现83%至93%断崖式下跌,且 OpenAI 工程师直言无论链接放得多显眼用户都不会点击时,行业此前维持的互利幻觉已经很难圆场。

流量失血实测:179次抓取换1次点击

如果说高管言论暴露了主观意图,那么客观数据则量化了这种掠夺的烈度。传统搜索引擎遵循抓取并引流的流量契约,爬虫抓取网页,换来的是搜索引擎源源不断送回的高价值跳转。但在生成式摘要面前,这个契约彻底失衡了。

皮尤研究中心2025年对近七万次搜索进行的实测显示,页面出现 AI 摘要时传统搜索结果的点击率直接腰斩,AI 摘要内部自带的来源链接点击率仅有1%,超过四分之一的用户看完摘要便直接终止浏览。2026年的现场测试进一步验证了这一趋势:AI Overviews 的展示直接导致外链自然点击量下滑39.8%,全网零点击搜索激增34.5%,且仅有7.1%的外链点击真正来自 AI 答案本身。

内容消耗与流量回传失衡账本 179 : 1 OpenAI 抓取与回流比 每抓取检索 179 次仅引流 1 次 -39.8% 外链自然点击量下滑 AI Overviews 出现后直接截流 0.11% AI 引流占总访问比重 ChatGPT 占九成却几无反哺

根据 TollBit 的监测,OpenAI 每抓取检索179次仅产生1次外链引流,Perplexity 的转化比率更恶化至369比1。虽然 ChatGPT 在独立 AI 引流中拿下了92%的份额,但所有 AI 渠道引流加起来,在出版商全网自然访问量中的占比仅仅只有0.11%。Similarweb 的全网走势印证了这种结构性倒挂:AI 摘要上线后全美新闻网站搜索流量整体下跌26%,同期 ChatGPT 上的新闻类查询却暴增212%。中小媒体在两年内承受了47%至60%的流量缩水,原本依靠公共流量支撑的商业基石被整块抽离。


厄运循环反噬大模型供应链

这不仅是出版商的危机,也是技术本身的慢性自杀。一份解密的微软文件直白地记录了这种厄运循环:终道产品正在摧毁自己必不可少的原材料供应商,这种局面在整个商业史上都极为反常。

大语言模型建立在海量、高质量、持续更新的人类智力成果之上。调查记者冒着风险核实的一线报道、深度分析师花费数周梳理的行业事实,被爬虫在数毫秒内抽取为向量参数。当媒体因严重失血而缩减采编团队、收缩报道范围甚至破产关门时,互联网上高质量原生语料的产出速度将急剧放缓。取而代之的,是低成本洗稿机和机器自我复制生成的合成数据废料。

斩断了活水来源,模型最终只能在近亲繁殖的合成垃圾中逐渐退化。

天下熙熙皆为利来,这场生态崩塌的本质是公地悲剧。各家技术巨头在商业竞速中陷入了典型的囚徒困境:谁都知道长期来看需要健康的创作者生态,但当对手都在免费抓取以拉高估值与用户留存时,主动花钱买授权的公司在短期报表上就会吃亏。Greg Brockman 在内部直言被海量商业回报所驱使,正是这种资本冲刺下漠视供应链安全的心态写照。

  • 风险.若纽约南区联邦法院在此次简易判决中裁定直接侵权,微软与 OpenAI 不仅面临天价赔偿,更可能被迫对包含侵权语料的模型实施强制重新训练,整个底层数据获取模式必须全面退回付费授权池。

虽然路透社研究所等第三方机构客观指出,媒体流量下行不能单方面归咎于 AI 摘要,算法变迁与受众习惯变化同样在起作用;但毫无疑问,生成式搜索正在以前所未有的效率切断原创者的造血回路。法庭卷宗里的言论并不是八卦,而是一记警钟:技术可以无限扩展复制能力,却无法无中生有地创造事实。当采蜜者把花园里的花朵连根拔起时,所谓的人工智能繁荣,不过是一场透支未来的倒计时。