Home 科學技術 数学家想要证明他们的成果没有被 OpenAI 使用

数学家想要证明他们的成果没有被 OpenAI 使用

10
0
数学家想要证明他们的成果没有被 OpenAI 使用

另一位研究人员就推动 OpenAI 日益令人印象深刻的数学发现的数据向 OpenAI 发起挑战。在围绕该公司的模型是否受益于未发表的工作而引发激烈争论几天后,第二位数学家站出来指责这家人工智能公司不道德和“不诚实”的行为,以及其训练数据的来源缺乏透明度。

一个 帖子 在 Mastodon,数学家 Andreas Thom 表示担心,在 OpenAI 成功宣布之前,他和他的同事与 ChatGPT 聊天机器人的互动可能有助于其在该领域的成功。十分之一 结果 OpenAI 上个月大张旗鼓地宣布 Thome 的专业领域是所谓的非 Sophic 群体,并且 OpenAI 承认他们的结果在很大程度上建立在 Thome 和数学家 Gabor Kuhn 之前的工作基础上。

纽约大学数学教授 Tristan Buckmaster 表示,在公开质疑 OpenAI 公司的 AI 模型是否受益于使用 OpenAI 的 Codex 后,他开始反思自己与 OpenAI 的互动。 OpenAI 宣布结束非 Sophic 小组后,因未能承认 Thom 和 Kuhn 最近的贡献而受到数学界的广泛批评,该组织悄悄修改了其文字。粗略地说,非智群是无法用有限数学结构来近似的无限数学结构。

Thom 表示,“OpenAI 对我们技术的全面掌握”也令他感到震惊,他表示当时并没有最明显或最有希望的解决方案。他说,他给 OpenAI 研究人员 Sébastien Bubeck 和哈佛大学统计学家 Mark Selke 写了电子邮件,询问他与 ChatGPT 的交互是否是“训练数据的一部分或可以用于推理过程”。

但他对答案并不满意,指出他与聊天机器人的对话是否可以直接访问,而不是该公司是否有权访问用于改进模型的大量培训数据。 “没有给出这样的资格、解释或证据,”他写道。 “我认为这是不诚实。”

Thome 表示,研究人员还没有准备好对 OpenAI 的训练流程进行逆向工程,以确定他们的工作是否已被使用。 “只有 OpenAI 拥有这方面的数据。”他说,如果该公司否认这样做,他们就有责任通过披露所有必需的数据集并澄清规定他们如何使用数据的各种系统和法规来证明这一点。

OpenAI 不愿明确排除对用户数据的任何使用,这与它捍卫其最近的千年奖突破的方式相呼应,无论是在其公开信息还是在与 Buckmaster 的沟通中。在博客文章中 宣称 OpenAI 断然拒绝使用任何与流体运动有关的纳维-斯托克斯解决方案。 具体的 用户数据:“在他们公开之前,我们(研究人员和代理人)没有以任何方式查看他们的任何工作 – 特别是,没有专门访问任何用户数据来解决这个问题。”

但它并不能明确排除间接影响:“虽然可能性不大,但我们不能排除从使用我们的产品中获得的去识别化数据有助于改进我们的模型。”他说,与公司的沟通也存在同样模糊的区别。 “删除身份可能会删除名字;但它不会删除数学思想的知识内容,”他说。

他说,鉴于最近发生的事件,“塞尔克的明确回应至少是不合理的宽泛和实质上的误导;回想起来,这是不诚实的。”

汤姆表示,如果用户提供的非公开研究有助于改进模型,那么“在道德上是不安全的”。

OpenAI没有立即回应 边缘请求发表评论。

他的言论加剧了数学界对 OpenAI 日益增长的不安,这本应是该公司的突破时刻。它宣布解决数学著名的千年奖问题之一是一项非凡的壮举,如果得到证实,很少有人会否认。但由于 OpenAI 最初追求这个问题的不寻常情况,情况变得更加复杂:它听到网上有传言称其他研究人员已经取得了巨大进展,并认为不妨尝试一下。

这一持续发生的事件给数学家们留下了不好的印象。许多研究人员表示 边缘 如果数学家们知道,即使有传言称他们即将取得重大突破,也可能会引发与资源丰富、渴望荣耀的科技巨头之间的竞争,他们担心这种行为可能会让该领域陷入更加保密的状态。

关注主题和作者 在您的个性化主页源中查看更多类似内容,并通过此故事获取电子邮件更新。