新闻机构针对 ChatGPT 开发商 OpenAI 提起的一批版权侵权诉讼正进入一个新阶段,特朗普政府的干预引发了一个问题:人工智能公司需要支付多少费用才能获得其模型训练内容的许可。
这些案件包括《纽约时报》和 CNET 母公司齐夫·戴维斯 (Ziff Davis) 提起的案件。双方本月提交了一份简报,要求联邦法院就一系列问题做出裁决,特别是 OpenAI 对已发布材料的使用是否构成美国版权法规定的合理使用。
但联邦政府的利益声明称许可壁垒将给人工智能公司带来负担,这引起了 Ziff Davis 首席执行官维韦克·沙阿 (Vivek Shah) 的庭外谴责。 写作是运气Shah 将美国音乐行业的版税和许可费用总额(每年不到 200 亿美元)与 OpenAI 告诉投资者的预计到 2030 年计算基础设施支出为 7500 亿美元进行了比较。
沙阿写道,每年分配 200 亿美元用于新闻出版商的许可对于人工智能公司来说是一个“舍入误差”,但对于出版商来说却很有意义。 “合理的收费结构创造了高质量投入和高质量输出的飞轮,这有利于人工智能消费者和公共利益。”
OpenAI 代表指出该公司 关于诉讼的博客文章,指的是其与新闻组织的合作伙伴关系。博客文章称:“人工智能系统是新闻业和普通美国人的一股造福力量。”
阅读更多: 我们都是版权所有者。欢迎来到人工智能造成的混乱
这篇社论是在版权案件漫长的发现过程结束时发表的。出于证据开示的目的,针对 OpenAI 和 Microsoft 的各种单独索赔在一名法官面前进行了合并。现在,双方已经收集了过去几年收集的证据,并向法院提出了初步论点,法院可以在将个别案件发回其司法管辖区进行可能的审判之前就一些关键问题做出裁决。
在一个 分享总结 (PDF) 新闻出版商——包括 Ziff Davis、《纽约时报》和《纽约每日新闻》——辩称,使用他们发布的内容来训练 ChatGPT 破坏了网络流量,并削弱了人工智能生成的“粉红粘液”内容的市场。
出版商表示:“毫无疑问,如果被告的行为变得普遍且不受限制,将会发生什么,因为这种情况已经发生了。” “2022 年 11 月发布的 ChatGPT 的一个影响是激励 Google 等其他公司加速其 GenAI 产品,其中最重要的是 Google AI Overview。”
阅读更多:诉讼称,谷歌的人工智能揭示了损害出版商的“不当行为”
OpenAI 声称 您的存款 (PDF) 其使用从互联网上抓取的数据构成了合理使用,因为它“具有高度变革性,作品高度现实,并且之前的培训没有对这些作品的市场或价值造成任何明显的损害。”
至于许可,OpenAI 辩称,其对发布者上下文的访问是隐式许可的,因为发布者当时并未使用 robots.txt(告诉机器人是否可以访问该页面)或其他方式阻止该公司的数据挖掘工具。
“几十年来,像谷歌这样的搜索引擎——它通过爬行(即复制)互联网上的几乎每个网页来构建网络索引——以及其他基于网络的产品和服务都依赖于爬行或抓取互联网,”OpenAI 辩称。 “事实上,新闻行业的原告使用他们自己的网络抓取工具。人们早就知道,除非网站所有者通过 robots.txt 协议等机制选择退出,否则这种复制是隐式授权的。”
许多出版商现在阻止 OpenAI 和其他人工智能公司附属的机器人访问他们的网站。沙阿在他的专栏中写道,这些类型的障碍和付费墙将变得更加困难,限制信息的获取并阻碍开放的互联网。 “这一切都是因为我们允许错误的假设,即继续不受反对地获得许可是困难且昂贵的。”







