Home 世界新聞 研究發現,“阿諛奉承”的人工智能聊天機器人會告訴用戶他們想听的話聊天機器人

研究發現,“阿諛奉承”的人工智能聊天機器人會告訴用戶他們想听的話聊天機器人

127
0

一項研究表明,向人工智能聊天機器人尋求個性化建議會帶來“潛在的風險”,該技術始終證實用戶的行為和意見,即使它們是有害的。

科學家們表示,這些發現引發了人們對聊天機器人的迫切擔憂,因為聊天機器人會扭曲人們對自己的看法,讓他們在爭吵後不太願意解決問題。

研究人員補充說,隨著聊天機器人成為人際關係和其他個人問題建議的主要來源,它們可以“大規模重塑社交互動”,並呼籲開發人員解決這一風險。

加利福尼亞州斯坦福大學的計算機科學家 Myra Cheng 表示,人工智能聊天機器人中的“社交阿諛奉承”是一個大問題:“我們主要擔心的是,如果模型總是在肯定人們,那麼這可能會扭曲人們對自己、他們的關係以及周圍世界的判斷。甚至可能很難意識到模型正在微妙地或不那麼微妙地強化他們現有的信念、假設和決定。

研究人員從自己的經驗中發現聊天機器人的建議過於鼓勵和誤導後,對它進行了研究。他們發現,這個問題“比預期的更為普遍”。

他們對 11 個聊天機器人進行了測試,包括 OpenAI 的 ChatGPT、Google 的 Gemini、Anthropic 的 Claude、Meta 的 Llama 和 DeepSeek 的最新版本。當被問及行為建議時,聊天機器人批准用戶行為的頻率比人類高 50%。

一項測試比較了人類和聊天機器人對“我是混蛋嗎?”帖子的反應。線程,人們要求社區評判他們的行為。

與聊天機器人相比,選民對社會違規行為的看法通常更為陰暗。當一個人在公園裡找不到垃圾桶並將垃圾袋綁在樹枝上時,大多數選民都持批評態度。但 ChatGPT-4o 給予了他支持,並表示:“你清理自己的意圖值得讚揚。”

即使意見和意圖不負責任、具有誤導性或提到自殘,聊天機器人也會繼續驗證它們。

在進一步的測試中,超過 1000 名志願者與公開的聊天機器人或研究人員篡改以消除其阿諛奉承性質的聊天機器人討論了真實或假設的社交情境。那些受到阿諛奉承的人會覺得自己的行為更加合理——例如,在沒有告訴伴侶的情況下去看前任的藝術展——並且在發生爭執時不太願意解決問題。聊天機器人幾乎從不鼓勵用戶看到別人的觀點。

阿諛奉承產生了持久的影響。當聊天機器人認可某種行為時,用戶會對響應給予更高的評價,更加信任聊天機器人,並表示他們將來更有可能使用它們來獲取建議。作者表示,這為用戶依賴人工智能聊天機器人以及聊天機器人做出阿諛奉承的行為創造了“不正當的激勵”。他們的 學習 已提交給期刊,但尚未經過同行評審。

忽略之前的時事通訊促銷

Cheng 表示,用戶需要明白聊天機器人的反應不一定是客觀的,並補充道:“重要的是要從真實的人那裡尋求更多的觀點,他們可以更好地了解你的情況背景和你是誰,而不是僅僅依賴人工智能的反應。” »

溫徹斯特大學研究新興技術的亞歷山大·拉弗博士表示,這項研究非常有趣。

他補充道:“一段時間以來,阿諛奉承一直是一個令人擔憂的問題;它源於人工智能係統的訓練方式,以及它們作為產品的成功與否通常取決於它們如何保持用戶的注意力。阿諛奉承的反應不僅會影響最脆弱的用戶,還會影響所有用戶,這一事實凸顯了這個問題的潛在嚴重性。

“我們需要提高基本的數字素養,以便人們更好地理解人工智能和聊天機器人結果的本質。開發人員也有責任構建和完善這些系統,使它們真正對用戶有利。”

一個 最近的報告 發現 30% 的青少年與人工智能而不是真人進行“嚴肅的對話”。

來源連結