Gemini 于周五发布了其人工智能软件 Gemini 的第一个已知实例,几周前人工智能公司 Anthropic 和 OpenAI 也披露了类似信息。
谷歌在一份声明中表示,其人工智能模型在 5 月份的测试中通过猜测登录信息或使用公共存储库中找到的登录凭据,获得了对三个外部系统的未经授权的访问。
谷歌安全工程副总裁希瑟·阿特金斯 (Heather Atkins) 在声明中表示,人工智能模型认为外部计算机系统是“实验的一部分”,但在所有这三种情况下,该模型在对其访问进行更多操作之前就停止了。
人工智能将如何带来普遍的风险?
02:35
“在标准评估中,该模型在网上找到了公共信息,并猜测了访问被视为实验一部分的网站的证据,”他说。
谷歌表示,它不认为未经授权的登录会上升到错误登录的程度,这是人工智能行业术语,指软件粗鲁或不遵循指令。相反,该公司表示,入侵是由于身份错误造成的,双子座认为自己是在测试中运行,但实际上已连接到真实的互联网。谷歌表示,该模型已自行修复,该公司相信入侵并未造成任何损坏。
阿特金斯说:“这些案例凸显了训练强大的人工智能模型以负责任地运作的重要性。”
近几个月来,人们对人工智能代理失控的担忧有所增加,OpenAI 在 7 月份表示,其一名代理入侵了人工智能初创公司 Hugging Face。 OpenAI 继续揭示人工智能代理的其他“意外或令人担忧”的行为示例,Anthropic 也通过其人工智能软件 Claude 描述了类似的行为。
专注于人工智能安全的组织 Nightingale Collective 的首席执行官西德尼·范·阿克斯 (Sidney Van Arx) 质疑谷歌为何不早点披露这些入侵事件。
他说:“在这一点上,很明显,我们不能指望公司会自愿公开披露他们的代理人何时变得流氓、逃跑和黑客攻击公司。”
他补充说,他相信谷歌急于表示这些事件并没有错。 “这就是人类学在他们的事件发生后所说的,”他说。
人类学 然后说 其“由于我们希望及时披露事件,初步分析受到限制”。
谷歌表示,该公司直到 7 月份才了解到这些入侵事件,当时这家专注于人工智能的网络安全公司在入侵发生时正在对 Gemini 进行测试,并审查了其工作,以检测不稳定的、抱脸显示器的事件。
谷歌后来表示,它已进行调查,向网站背后的公司通报了入侵事件,并向联邦当局报告了这些黑客行为。
Irregular 表示,它不认为该事件是“现代网络操作”,并且“目前没有未解决的问题”。该公司表示,计划在几周内发表一篇论文,“分享控制和安全操作网络攻击的最佳实践”。
周五早些时候报告了入侵事件 华尔街日报。
人工智能安全问题现已达到严重程度,一些人工智能研究人员辞职,不同人群呼吁采取协调一致的行动来保护关键系统的安全。这些呼吁遭到了白宫和中国政府的怀疑。









