OpenAI为人工智能生成的文本添加隐形水印

OpenAI 在 ChatGPT 和 Codex 软件代理生成的文本中添加了隐形水印,使机器更容易识别出它是由 AI 编写的。 周一宣布这一改变在欧盟是强制性的,目前世界其他地区的 API 客户也可以接受。

参见:

ChatGPT 有新的广告格式。这就是他们的样子。

大型语言模型的工作原理是一次一个单词地创建文本,并通过查看之前的内容来确定接下来的内容。全新OpenAI文本水印系统 文字颗粒 通过改变人工智能模型选择单词的方式来影响这一点,以考虑前面的文本和由密钥确定的伪随机值。

这会在生成的内容中留下统计信号,允许人工智能检测引擎找出这些伪随机值是什么,并确定文本是否依赖于它们。如果是的话,那么它就被标记为人工智能。

OpenAI 文本水印将在未来几周内在欧盟的 ChatGPT 和 Codex 上推出。它也可供全球 API 客户选择型号使用,但他们必须做出选择,因为它默认处于关闭状态。

然而,OpenAI 的文本水印检测工具将仅向请求访问的研究人员和专业人士开放。 OpenAI 表示,这一限制部分是由于其文本水印的限制,特别是较短的段落。在测试中,该工具仅在人工智能生成的 200 字段落中捕获了 80% 的水印,当提到数学等具有严格词汇的主题文本时,检测率甚至更低。

编辑 AI 生成的文本也会显着降低 OpenAI 检测工具的有效性。该公司表示,在 400 个单词的段落中,仅更改 10% 的单词,检测率就会降低至 66%,而替换 25% 的单词,检测率甚至会下降至 17%。

OpenAI 在其声明中表示:“文本水印和检测仍然是早期技术,具有很大的局限性,对其好处和负责任使用的看法仍在不断发展。”

OpenAI 进一步强调,文本水印无法证明所创建内容的所有权、证明其准确性或识别请求者。即使没有水印也不能证明该内容是由人类创建的。


图片来源:OpenAI

OpenAI 的新文本水印是对欧盟人工智能法的回应。据当时的一份新闻稿称,该法规最初于 2024 年签署,旨在“保护基本权利、民主、法治和环境可持续性免受高风险人工智能的影响”。欧盟人工智能法 逐渐生效 从 2025 年开始,大多数条款从今年 8 月 2 日起生效。

这包括 第 50 条第 2 款, 该法案要求人工智能系统的提供者“确保人工智能系统的输出以机器可读的形式进行标记,并且可以被检测为人工生成或操纵的”。 OpenAI 等在 8 月 2 日之前发布人工智能模型的提供商必须在 12 月 2 日之前遵守第 50(2) 条,否则将面临高达其全球年营业额 3% 的罚款。

上星期, 路透社报道 OpenAI 的年度经常性收入接近 700 亿美元(尽管他们也承认 这样的计算可能会产生误导)。因此,违反第 50(2) 条可能会让 OpenAI 面临超过 20 亿美元的罚款。

今年早些时候,Anthropic 还宣布其人工智能聊天机器人 Claude 将创建符合欧盟规则的水印。与 OpenAI 不同,Anthropic 水印可供全球所有用户使用,而不仅仅是欧盟的用户。


披露:Mashable 的母公司 Ziff Davis 于 2025 年 4 月对 OpenAI 提起诉讼,指控其在训练和运营其人工智能系统时侵犯了 Ziff Davis 的版​​权。