2026-09-18 04:41
AI123

法庭文件披露:微软高管曾将AI训练抓取称为“盗窃”

2026年9月,《纽约时报》诉OpenAI与微软的版权案新解封文件披露,微软一名高管私下将抓取内容训练AI模型称为“盗窃”;OpenAI领导层也承认,其AI产品对出版商构成“生存威胁”。

文件还详述了两家公司涉嫌绕过付费墙、大规模抓取内容构建训练数据集,并刻意剥离训练数据中的版权声明。微软应用科学总监Brent Hecht在2023年1月内部备忘录中称之为“规模空前的惊人盗窃”和“人类历史上最大规模的劳动盗窃”。OpenAI的ChatGPT负责人Nick Turley在内部沟通中称,ChatGPT等产品对出版商构成“生存威胁”,且“在很大程度上具有替代性,会随着能力提高而更具替代性”。

文件引用微软CEO萨蒂亚·纳德拉2026年早些时候的证词称,任何有付费墙的内容都应获得许可后才能使用;若他事先知道OpenAI抓取并训练了付费墙后的信息,会要求OpenAI重新训练模型。微软数据还显示,Copilot“答案引擎”使《纽约时报》网站点击率较传统必应搜索最高下降93%,内部演示将其称为“末日循环”。

解封文件首次披露,OpenAI的中期训练数据集含超过91,692份来自《纽约时报》《每日新闻》和调查报道中心的作品副本;一个来自Common Crawl的数据集仅nytimes.com文档就超过200万份。文件还称,OpenAI员工曾策划绕过付费墙,并在数据进入模型前剥离版权声明。

需注意,这些新披露信息多出自《纽约时报》的诉状,而非底层证据,原始证据仍处于密封状态。OpenAI与微软未回应置评请求。

来源
  1. 2026-09-18 11:23 | 澎湃新闻:法庭文件:微软高管承认AI可能破坏新闻业,是“规模空前的劳动盗窃”
    阅读原文

    最新解封的法庭文件显示,微软和OpenAI的内部记录表明,两家公司的高管私下均承认其人工智能产品可能会破坏新闻行业。美国媒体《纽约时报》17日公开的法律文件显示,微软应用科学总监布伦特·赫希特(Brent Hecht)表示,人工智能模型训练是“人类历史上最大规模的劳动盗窃”。在另一场合,他将此形容为“规模空前、令人震惊的盗窃行为”。OpenAI旗下产品ChatGPT的负责人尼克·特利(Nick Turley)在内部场合表述得更为直白:“我们的产品在很大程度上就是替代品,无需多言。”他还写道,新闻机构正面临来自使用新闻内容训练的商业化产品的“生存威胁”,并预测聊天机器人“随着性能的提升,替代性将...

  2. 2026-09-18 08:25 | IT之家:微软及 OpenAI 内部文件曝光:高管曾警告 AI 可能对新闻机构产生“毁灭性影响”
    阅读原文

    IT之家 9 月 18 日消息,随着美国《纽约时报》等新闻机构持续推进就微软、OpenAI 之间针对训练数据版权问题的诉讼,微软和 OpenAI 内部一批此前被标记为机密的文件现已正式公开,其中展示了微软和 OpenAI 内部员工对 AI 影响的担忧。其中,微软应用科学部门主管 Brent Hecht 曾在内部文件中警告,将新闻内容用于 AI 训练是“前所未有的大规模盗窃”,甚至称其可能是“人类历史上规模最大的劳动力盗窃”。在另一份文件中,Hecht 还质疑微软和 OpenAI 关于 AI 训练新闻内容属于合理使用(Fair Use)的观点,认为大规模抓取新闻内容的做法可能与“合理使用”的理念...

  3. 2026-09-18 03:46 | TechCrunch:Microsoft exec called AI scraping ‘the largest theft of labor in human history,’ new unredacted filings reveal
    阅读原文

    New unredacted information in the copyright lawsuit The New York Times brought against OpenAI and Microsoft three years ago reveals an admission that AI scraping was tantamount to theft, and that AI products pose a major threat to publications. Per the lawsuit, a top Microsoft executive privately d...

其他新闻

查看全部