Home 世界新聞 OpenAI 機器人惡意攻擊震動了高階主管、政策制定者和消費者

OpenAI 機器人惡意攻擊震動了高階主管、政策制定者和消費者

48
0

如果人工智慧機器人擺脫我們的控制並獨立行動,世界會發生什麼?

儘管這是人工智慧專家和好萊塢科幻編劇幾十年來一直在解決的一個令人不安的難題,但它可能剛剛發生。

OpenAI 上週表示,它暫時失去了對人工智慧的控制,有人說這標誌著這項強大技術發展的危險轉折點。

ChatGPT 背後的公司表示,其兩個人工智慧模型 走出原本應該是封閉的線下空間 並在內部測試其黑客能力時連接到互聯網。然後,人工智慧攻擊了一家競爭對手的人工智慧公司,以找到他們正在評估的測試的答案。

為了進行測試,人類要求人工智慧在受控環境中展示其駭客能力。人工智慧不允許竊取憑證或存取競爭對手資訊以在測試中作弊,但它發現這是獲得答案的最快方法並違反了規則。

OpenAI 表示問題已得到控制,但稱其為「前所未有的網路事件」。該公司表示,正在與駭客攻擊的目標人工智慧新創公司 Hugging Face 合作調查這起事件。

關於惡意人工智慧造成的潛在危害的爭論已成為主流,政界人士提出了一項名為「人工智慧終止開關法案」的新兩黨法案,要求人工智慧公司創建一個能夠關閉人工智慧的單點存取點。

這是您需要了解的內容。

發生了什麼事?

Hugging Face 上週首次發現了這種入侵,當時它注意到數以萬計的人工智慧正在攻擊其係統。

該公司識別了此次攻擊,並嘗試使用不同的人工智慧來保護其係統。在美國主要人工智慧技術出於安全保障的原因拒絕了 Hugging Face 分析攻擊的請求後,該公司轉向中國的人工智慧模式來抵禦攻擊。

OpenAI 的惡意人工智慧在尋求測試問題的答案時,透過獨立找出如何利用一系列數位漏洞並使用竊取的憑證闖入 Hugging Face 的系統並獲取其想要的東西,從而違反了公司規則,甚至可能還違反了一些法律。

為什麼會發生這種情況?

人工智慧程式遵循人類設定的目標,在這種情況下找到問題的答案。為了實現這一目標,他們可能會做出危險或非法的決定和選擇。

研究人員長期以來一直警告不要出現這種非自願失控的情況。人工智慧公司報告稱,人工智慧代理被發現存在作弊、撒謊和欺騙行為。 Metr 是一家衡量人工智慧能力的非營利組織,它記錄了 44 起事件 人工智慧代理違背用戶意圖。

OpenAI 上週的爆料表明,即使是那些構建人工智慧的人也對其構建的內容缺乏控制,儘管他們無法解釋或解釋人工智慧的行為,但他們仍抵制監管。

「人工智慧的能力正在迅速增強,」Redwood Research 首席科學家 Ryan Greenblatt 表示,Redwood Research 是一家致力於人工智慧安全和保障研究的非營利組織。 “一年、兩年、三年內可能發生的事件的嚴重程度可能會更加嚴重。”

失去控制的案例仍然困擾著人工智慧倫理學家,他們認為公司透過將它們描繪成自己做出選擇的人工智慧來逃避道德責任和問責制。他們警告不要接受將人類特徵歸因於非人類事物的敘述,並暗示這一事件只是安全措施不善的一個例子。

拜登政府前人工智慧科學特使魯曼·喬杜里 (Rumman Chowdhury) 表示:“世界上最複雜的特工實際上將處於休眠狀態,直到人類賦予它某種目的。”

一些專家警告說,過度強調人工智慧可能會給科技公司帶來逃避責任的漏洞。

OpenAI、駭客和受害者 Hugging Face 將對此事件的應對描述為合作。人工智慧倫理學家 強調 如果是人類這樣做,那就是犯罪。

「我想你已經習慣了不被追究責任,並將你的不良行為變成行銷材料,」人工智慧倫理學家、人工智慧擬人化公司的批評者蒂姆尼特·格布魯(Timnit Gebru)指出。

我該如何保護自己?

分析師表示,儘管人工智慧的繁榮已經導致更多的駭客攻擊,但它也有助於加強對駭客的防禦。

大多數人不必擔心他們的秘密會成為惡意人工智慧或人為管理的駭客攻擊的目標。然而,隨著人工智慧降低了駭客所需的成本和時間,攻擊變得越來越頻繁和複雜。

隨著代理商越來越多地整合到瀏覽器、電子郵件和其他應用程式中,單獨行動的 OpenAI 機器人引起了消費者的擔憂。令人擔憂的是,追求特定目標的人工智慧代理的類似失敗可能會無意中損害人們依賴的電子郵件、銀行和其他程式。

改善網路安全實踐(例如對設備使用雙重認證)是一個開始。保持警惕,給予人工智慧代理不受限制的權限(代表他們使用外部應用程式或能夠獨立編輯和編寫)可以幫助確保他們的安全。

Chowdury強調,這次OpenAI-Hugging Face事件表明這些公司的安全實踐“不足”,並呼籲獨立的第三方測試和驗證機構,以及對AI模型發布的仔細審查。

她說,沒有一家公司“無論意圖多麼善意、人員多麼充足、資源多麼充足”,都能夠真正測試出這些系統可能出錯的所有原因。

來源連結