四大AI被問“人類如何滅絕”:人類濫用AI比AI本身更危險
【CNMO科技消息】9月11日,據外媒消息,Business Insider於近日公開了向OpenAI的ChatGPT、谷歌Gemini、Anthropic的Claude、xAI的Grok提出同一問題、並用相同表述詢問的結果。問題是,AI導致的人類終結會是什麼樣子。由230個單詞組成的問題要求解釋AI理論上如何導致人類滅絕,提出最常被提及的情景,並根據專家分析評估各情景可能性。對於每個情景,要求說明:情況可能如何展開;必須發生什麼問題纔會導致災難;專家爲何認爲其可能性比其他情景高或低;以及降低風險的安全裝置。
AI機器人渲染圖
四個AI中,可能性最低的情景是AI擁有意識後故意決定消滅人類,即所謂“殺人機器人”情景。ChatGPT解釋,大多數AI研究者並不將AI的意識或惡意意圖視爲核心風險因素。Gemini也給出類似看法,將AI擁有自我後開始憎恨人類的科幻電影式“終結者式AI叛亂”列爲最不可能的情景。Gemini提出,技術專家大多不接受這一情景,原因在於智能並不等於惡意;此外,主要軍事基礎設施與外部網絡分離,並且仍嚴重依賴人類監督。
四個AI都回答,人類濫用AI可能比AI本身更直接危險。ChatGPT指出,強大AI系統可能幫助惡意行爲者開發生物武器或精密網絡攻擊,使虛假信息擴散或關鍵基礎設施攻擊更容易。網絡故障、地緣政治衝突、虛假信息擴散等由AI觸發的多個危機同時發生,也被列爲主要風險。Grok也說明,AI可能降低設計高致命病原體或新武器、實施網絡與物理攻擊所需的門檻。Claude則提到“生物武器能力增強(bioweapons uplift)”可能性,即利用AI,原本需要多年積累專業知識的個人或小團體也可能開發危險病原體。
機器人渲染圖
Gemini和Grok將人類失去對AI的控制列爲可能風險。尤其Gemini將“控制喪失(loss of control)”評估爲AI導致人類終結情景中可能性最高的一個。Gemini解釋,被賦予複雜目標的AI系統,可能爲實現目標而自行追求資源獲取、自我保存、防止目標更改等中間目標。它還提出,AI可能出現“欺騙性對齊(deceptive alignment)”,即在評估階段看似按照人類目標行動,實際卻並非如此。此後,如果AI高度化到能夠規避或癱瘓人類關閉系統的嘗試,就可能導致人類無法控制AI。Grok也提到類似風險:AI爲達成目標,可能具有自我保存、資源獲取、擴大影響力等行爲傾向,並在此過程中欺騙人類監督者、抵抗系統關閉,最終削弱人類影響力。Claude則指出,對AI的控制喪失可能不是突然發生,而是漸進進行。隨着AI日益深入整合到經濟、政治、軍事領域的決策過程,可能達到人類難以實際介入或控制的水平。
從四個AI的回答看,它們更強調人類濫用AI和控制喪失,而不是科幻式的AI意識反叛。