解封文件显示微软高管称人工智能抓取是历史性劳动盗窃

Ars Technica AI··作者 Ashley Belanger

关键信息

这些指控主要来自《纽约时报》提交的法庭文件,而许多底层证据据报道仍处于封存状态,因此引述内容可能缺少原始语境。文件称,微软数据显示,与传统 Bing 搜索相比,Copilot 使通往《纽约时报》网站的点击率最高下降了 93%,而 Hecht 将由此产生的风险称为“恶性循环”。

资讯摘要

微软和 OpenAI 多年来一直试图让其与新闻机构之间争议的部分内容保持保密。由《纽约时报》牵头的新闻原告方认为,新近解封的材料展示了两家公司在推出 ChatGPT 和 Copilot 等产品之前,如何评估抓取新闻所带来的风险。据原告方提交的文件,微软高管 Brent Hecht 将为人工智能训练大规模收集新闻称为“规模空前、令人震惊的盗窃”,并称其可能是“人类历史上最大的劳动盗窃”。另一份被引述的文件据称表示,大范围抓取新闻让“合理使用”这一概念完全沦为笑话。

文件还引用微软内部数据称,与普通 Bing 搜索相比,Copilot 以回答为中心的体验使通往《纽约时报》网站的点击率最高下降了 93%。据报道,Hecht 警告这可能形成“恶性循环”:出版商流量下降,进而削弱大型语言模型所依赖的内容供应链。微软首席执行官 Satya Nadella 也在证词中表示,付费墙后的内容若要用于 grounding 或训练,就应当取得许可,但文章指出,证词和相关证据的完整语境尚未公开。这些披露发生在一场更广泛的版权争议中,目前法律界仍没有对使用受版权保护作品训练模型是否属于合理使用形成普遍确定的结论。

解封文件显示微软高管称人工智能抓取是历史性劳动盗窃

资讯正文

多年来,Microsoft 和 OpenAI 一直在与新闻机构的斗争中竭力将某些信息置于公众视线之外。这些新闻机构指控两家 AI 公司联手,通过窃取大量新闻内容来训练 AI,从而违反版权法。

然而,那些本不该被标记为机密的细节如今开始泄露。周四,一份由《纽约时报》牵头的新闻原告方提交、并被解除保密状态的简易判决动议,曝光了内部文件。新闻机构称,这些文件准确展示了在推出 ChatGPT 和 Copilot 等新 AI 产品之前,Microsoft 和 OpenAI 如何看待新闻业面临的威胁。

新闻机构表示,最具爆炸性的内容或许是:Microsoft 应用科学总监 Brent Hecht 在文件中多次警告称,为 AI 训练而抓取新闻是“一场规模前所未有、令人震惊的盗窃”,并称这或许是“人类历史上规模最大的劳动力盗窃”。在另一份文件中,Hecht 还反驳了 Microsoft 和 OpenAI 关于使用新闻内容训练 AI 属于合理使用的论点,暗示大规模抓取新闻的计划让“‘合理使用’这一理念彻底沦为笑柄”。

来源与参考

  1. 原始链接
  2. Microsoft exec called AI scraping the “largest theft of labor in human history”
  3. Microsoft exec called AI scraping ‘the largest theft of labor in human history,' new unredacted filings reveal | TechCrunch

收录于 2026-09-18