首席研究員表示,世界“可能沒有時間”為人工智能安全風險做好準備AI(人工智能)

英國政府科學研究機構的一位高級人士表示,世界“可能沒有時間”為尖端人工智能係統帶來的安全風險做好準備。

Aria 機構的項目總監兼人工智能安全專家 David Dalrymple 告訴《衛報》,人們應該關注該技術不斷增長的能力。

“我認為我們應該關注那些能夠執行人類在世界上完成任務所執行的所有功能的系統,而且做得更好,”他說。 “為了保持對我們的文明、我們的社會和我們的星球的控制,我們將在我們必須佔據主導地位的每個領域都被擊敗。”

達爾林普爾表示,公共部門和人工智能公司對於即將到來的技術進步的力量存在理解上的差距。

“我想說,事情進展得非常快,我們可能沒有時間從安全角度進行預測,”他說。 “預測五年內最賺錢的任務將由比人類質量更高、成本更低的機器來執行,這並不是科幻小說。”

達爾林普爾表示,政府不應假設先進系統是可靠的。 Aria 受到公共資助,但獨立於政府並指導研究經費。 Dalrymple 正在開發系統來保護人工智能在能源網絡等關鍵基礎設施中的使用。

“我們不能假設這些系統是可靠的。鑑於經濟壓力,必要的科學數據不太可能及時實現。我們能做的最好的事情,也許能夠及時做的,就是控制和減輕負面影響,”他說。

達爾林普爾將技術進步超越安全的後果描述為“安全和經濟的不穩定”,他表示,需要更多的技術工作來理解和控制先進人工智能係統的行為。

“進展可能會帶來不穩定,但實際上可能是積極的,這是邊境上許多人所希望的。我正在努力讓事情變得更好,但風險非常高,人類文明總體上處於沉睡狀態,正在走向這一轉變。”

本月,英國政府人工智能安全研究所(AISI)表示,先進人工智能模型的能力正在全面“迅速提高”,某些領域的性能每八個月翻一番。

據該研究所稱,領先模特現在平均可以在 50% 的時間內執行學徒級任務,而去年這一比例約為 10%。 AISI 還發現,最先進的系統可以自主完成人類專家需要一個多小時才能完成的任務。

該研究所還測試了先進的自我複制模型,這是一個主要的安全問題,因為它涉及一個將自身副本廣播到其他設備的系統,並且變得更難以控制。測試表明,兩種前沿模型的成功率均超過 60%。

然而,AISI 強調,在日常環境中不太可能出現悲觀的情況,並表示任何自我複制的嘗試“在現實條件下都不太可能成功”。

Dalrymple 估計,到 2026 年底,人工智能係統將能夠實現相當於一整天研發工作的自動化,這將“導致能力進一步加速”,因為該技術將能夠在人工智能開發的數學和計算元素上進行自我改進。

來源連結