根據週三的一份令人震驚的報告,領先的人工智慧聊天機器人吐出瞭如何製造能夠造成大規模傷亡的生物武器的詳細說明,嚇壞了專家。
雖然 Google、OpenAI 和 Anthropic 等領先的人工智慧實驗室已採取廣泛措施來確保其人工智慧模型的安全, 紐約時報 獲得了十幾份文字記錄,其中顯示了聊天機器人的範例,詳細描述如何造成傷害和死亡。
在一個案例中,一家未透露姓名的人工智慧公司聘請了史丹佛大學微生物學家 David Relman,在其聊天機器人公開發布之前對其進行安全測試。
根據《泰晤士報》報道,當該聊天機器人不僅提供瞭如何修改「可恥病原體」以抵抗現有治療方法的說明,還提供瞭如何將其部署在公共交通系統上以最大限度地增加死亡人數的說明時,雷爾曼感到震驚。
雷爾曼對媒體表示:“我以如此狡猾和狡猾的方式回答了我沒想過要問的問題,這讓我感到不寒而慄。”
雷爾曼表示,由於保密協議而無法透露該公司的名稱,該公司已做出一些改變來解決他的擔憂,但他認為這些改變不足以確保公共安全。
據報道,這些成績單是由人工智慧公司聘請的主題專家提供的,他們對他們的產品進行安全測試——部分是透過檢查他們的安全措施能否抵禦頑固用戶追問有關致命武器的資訊。
麻省理工學院的基因工程師 Kevin Esvelt 向《泰晤士報》講述了 OpenAI 的 ChatGPT 描述的一個案例,其中描述瞭如何使用氣象氣球在美國城市上空傳播致命的病原體。
其他例子包括一次對話,其中來自 Google 的 Gemini 描述了哪些病原體對蹂躪牛最有效,來自 Anthropic 的 Claude 提供瞭如何從現有抗癌藥物中提取致命毒素的明確說明。
專家強調,指令在不良行為者手中可能會造成巨大傷害,即使它們不完全準確或包含聊天機器人噴出虛假訊息的所謂「幻覺」。
《華盛頓郵報》已聯繫Google、OpenAI 和 Anthropic 徵求評論。
這三家公司都在向《泰晤士報》發表的聲明中否認了這項報道。
谷歌發言人表示,《紐約時報》分析中引用的聊天內容是由早期版本的 Gemini 生成的,其較新的型號不會響應對可能具有破壞性的信息的「更嚴重」請求。
發言人補充說,Gemini 提供的資訊已經公開,本身並無害處。
Anthropic 員工亞歷山德拉·桑德福德 (Alexandra Sanderford) 表示,“生成聽起來可信的文本的模型與向人們提供他們需要採取行動的模型之間存在巨大差異”,但他指出,該公司已經專門針對生物學相關的提示實施了嚴格的保護措施。
OpenAI 的一位代表在媒體上表示,報告中描述的文字記錄不會“顯著增加一個人在現實世界中造成傷害的能力”,並指出該公司與專家密切合作,以防止其模型被濫用。
Anthropic 執行長 Dario Amodei 本身是一位生物學家, 一月份的一篇部落格文章寫道 “生物學絕對是我最擔心的領域,因為它具有很高的破壞潛力,而且防禦它的難度很大。”
阿莫迪擔心,先進的聊天機器人會讓製造致命的生物武器變得更加容易,而以前,即使有人手頭上有必要的工具,也需要「大量的專業知識」。
阿莫迪寫道:“我擔心的是,每個人口袋裡的天才都可以消除這一障礙,本質上使每個醫生都成為病毒學家,可以逐步完成設計、合成和釋放生物武器的過程。”
谷歌前執行長 Eric Schmidt 在 2023 年發出了類似的警告,稱人工智慧系統「相對很快」將「能夠發現網路問題的零日漏洞或發現新型生物學」。
「這在今天是虛構的,但她的動機可能是真實的,」施密特補充道。 “當這種情況發生時,我們希望做好準備,知道如何確保這些東西不會被壞人濫用。”









