根据新闻出版商在一份报告中引用的评论,人工智能公司使用大量已发布的文本来训练他们的大型语言模型,这些公司的高管意识到这样做构成了盗窃受版权保护的材料。 提起诉讼 本周没有修改。
该备忘录最初是在本月早些时候提起的诉讼中提交的,该诉讼汇集了针对 ChatGPT 制造商 OpenAI 及其合作伙伴微软的几起相关版权侵权案件,其中包括《纽约时报》和拥有 CNET 的 Ziff Davis 提起的诉讼。
根据出版商提交的文件,微软应用科学总监布伦特·赫克特称这是“一次规模空前、令人震惊的盗窃案”,或许是“人类历史上最大的劳动力盗窃案”。解释文件中引用内容的完整证物仍处于密封状态。
出版商引用的评论似乎削弱了人工智能公司的论点,即使用受版权保护的材料作为合理使用受到法律保护。根据这一法律原则,受版权保护的材料的使用受到保护,具体取决于其使用方式、作品的性质、使用的数量以及使用对该作品市场的影响。
文件显示,微软首席执行官萨蒂亚·纳德拉 (Satya Nadella) 在宣誓后表示,与聊天机器人的对话“可以在人工智能平台的网站上提供信息,而不必前往主要来源”,例如报告信息的出版商的网站。同样,OpenAI 的一位高管写道,出版商面临着来自该公司聊天机器人等产品的“生存威胁”。
出版商的摘要还描述了人工智能开发人员为逃避付费墙而采取的步骤,例如《纽约时报》发表的摘要。他描述了一名 OpenAI 员工如何向公司总裁格雷格·布罗克曼 (Greg Brockman) 讲述“绕过纽约付费墙的黑客行为”,布罗克曼对此回应道:“哦,太好了。”
与此同时,文件称纳德拉作证说,付费墙背后的任何东西“都必须得到任何想要使用它的人的许可”来开发人工智能,如果他知道 OpenAI 接受付费内容的训练,他就会要求 OpenAI 重新训练其模型。
微软发言人在向 CNET 提供的一份声明中表示,赫克特的评论“反映了一名员工的观点”,该公司的立场包含在法庭文件中,“解释了为什么这些变革性用途符合版权法,以及为什么 Copilot 不能替代出版商新闻业。”
该发言人表示,纳德拉的言论涉及人们消费信息方式的变化,并且“完全符合”该公司的法律立场。 “这些观察结果不应与法庭上有关版权问题的结论相混淆,微软在其文件中对此进行了阐述。”
在其中 您的总结 在这种情况下,微软表示,使用已发布的内容来培训 LLM 持有者是一个重大转变。该公司表示:“版权法不允许权利持有者像权利持有者那样阻止变革性技术;它鼓励这种使用,希望权利持有者能够适应,公众也会过得更好。”
OpenAI 和 Ziff Davis 的代表没有立即回应置评请求。
MBA 接受过培训,涵盖开发人员可以获得的尽可能多的已发布内容,版权诉讼(包括书籍作者的相关案例)可能对人工智能公司和媒体产生重大影响。出版商表示,人工智能公司应该为他们使用的内容付费,而科技公司则表示,这样做对于开发更强大的人工智能来说是不必要的,而且是负担。特朗普政府本月早些时候对此问题发表了一份声明,称许可要求将阻碍美国人工智能在与中国的竞争中的发展。
出版商表示,OpenAI 和微软员工还意识到,他们的聊天机器人查找、复制、总结、有时反省出版商内容的能力阻碍了读者访问新闻机构的网站。
出版商的文件称:“被告的专家承认,受制裁的合法权利持有者正在利用他们的资源,而不是将其用于研究等被视为合理使用的用途。”










