2026-04-08 12:47
苹果、亚马逊、OpenAI 遭集体起诉:涉嫌非法爬取 YouTube 数据
文本核心速览
- 集体诉讼指控—苹果、亚马逊、OpenAI被指绕开YouTube反爬虫机制,非法下载数百万条视频用于AI模型训练,由三个YouTube频道联合发起。
- 核心数据集Panda-70M—该数据集将视频拆分为数千万样本,被控故意规避平台版权保护;苹果团队在论文中公开承认使用该数据集作为训练数据。
- 诉讼诉求明确—原告要求陪审团审理,提出法定赔偿、禁令救济,并申请判令被告支付判决前后利息及诉讼成本。
- 行业影响与人才争夺—案件凸显AI训练数据与版权冲突;苹果为阻止工程师跳槽OpenAI而发放高额奖金,OpenAI则持续从苹果硬件团队挖角。
三个YouTube频道直接把苹果、亚马逊和OpenAI告了:你们用Panda-70M数据集偷了我的视频
Ted Entertainment、Matt Fisher 和 Golfholics 三个YouTube频道正式提起集体诉讼,指控苹果、亚马逊和OpenAI绕过了YouTube的反爬虫防护机制,非法下载并使用了数百万条视频数据来训练其 AI 模型。起诉书里写着,这些科技巨头故意规避了YouTube为保护原创者而设立的版权保护系统。
核心指控:Panda-70M 数据集背后的“搬运”真相
诉讼争议焦点指向了一个名为 Panda-70M 的数据集。
- 数据索引化:该数据集通过网址、视频ID和时间戳,把海量视频拆分成数千万个独立的训练样本。
- 规避行为:有创作者发现,为了提取这些片段,苹果等公司的研究团队必须频繁访问并截取原视频内容。这一过程被指故意绕过了YouTube的版权保护系统。
- 证据确凿:苹果团队在关于视频生成模型 STIV 的研究论文中,曾公开提及使用该数据集进行训练。群里在传,这篇论文里的引用直接坐实了“偷数据”的事实。
诉讼诉求:要求陪审团审理并索赔
原告方代表所有“处境相同”的内容创作者,向法院提出多项主张:
- 法定赔偿:依据美国版权法,要求按法律最高限额进行金钱赔偿——具体数字要看判决,但按美国版权法每部作品最高15万美元算,数百万条视频的总金额会非常吓人。
- 禁令救济:要求被告及其关联方立即停止侵权行为,不得继续使用受版权保护的内容训练模型。
- 公平审查:申请判令支付判决前后的利息,并由被告承担律师费与诉讼成本。
行业背景:AI 时代的“公地悲剧”
这并非 AI 巨头首次因训练数据被告。有开发者试了说,大模型对高质量视频数据的需求已经让整个行业变成“谁先抢到谁赢”,但保护创作者权利与推动技术进步之间的平衡,全球监管都没彻底解决。
- OpenAI 的压力:继马斯克的反竞争诉讼后,OpenAI再次面临关于数据来源合法性的道德拷问。
- 苹果的转型挑战:一向强调隐私与版权保护的苹果,在此次事件中被指“故意规避保护系统”,对其品牌形象构成了不小的冲击。
延伸动态:人才争夺战愈演愈烈
在法律纠纷之外,巨头间的暗战早已升级。据相关报道,苹果正试图通过发放高额奖金,阻止其核心工程师跳槽至OpenAI。而OpenAI则在持续从苹果硬件团队中挖角,旨在为未来的 AI 硬件布局。
接下来盯着看什么
这场集体诉讼走向将决定全球AI训练数据的合法使用边界。谁最难受?苹果的品牌“干净”人设可能崩,OpenAI的融资故事里又多了一个法律风险。谁最受益?YouTube创作者——如果赢了,他们手里的视频直接变成高价授权资产。
来源: aibase阅读原文