隨著研究人員日益擔憂人工智能可能對人類造成傷害甚至導致滅絕,四大主流生成式人工智能模型近日針對「AI末日」情境給出預測,指出人類濫用技術是目前最迫切的風險。
本文核心內容:
· 發生地點:無特定地點
· 關鍵實體:OpenAI、谷歌、Anthropic與SpaceXAI
· 核心數據:向四大模型輸入二百三十字的相同提示詞進行測試
· 核心數據:四大模型均認為「殺手機器人」是最不可能發生的情境
OpenAI與谷歌模型解析AI末日 殺手機器人最不可能
開發熱門聊天機器人的研究人員越來越頻繁地表達對人工智能(Artificial Intelligence)可能傷害或終結人類的擔憂。為此,測試者向四款最常用的生成式人工智能工具提出了相同的問題:人工智能末日會是什麼樣子?這四款工具分別是OpenAI的ChatGPT、谷歌(Google)的Gemini、Anthropic的Claude以及SpaceXAI的Grok。
測試者使用了一段包含二百三十個單詞的提示詞,要求模型以清晰易懂的語言解釋人工智能在理論上如何導致人類滅絕,並根據專家的最佳分析,將最常被引用的情境從最不可能到最可能進行排序。ChatGPT以平衡且具解釋性的語氣回應,指出該主題存在很大的不確定性。它強調,最不可能的情境是流行的「殺手機器人」敘事,即有意識的人工智能故意決定消滅人類。大多數研究人員並不將意識或惡意視為核心擔憂。Gemini也呼應了這點,認為科幻電影《終結者》(Terminator)中人工智能產生自我意識並開始仇恨人類的情節是最不可能的。Gemini指出,技術專家大多駁斥這種說法,因為智力不等於惡意,且關鍵軍事基礎設施仍然與物理網絡隔離,並高度依賴人類監督。
Anthropic與SpaceXAI警告 人類濫用技術成最大風險
在回應中,四款聊天機器人均表示,許多專家認為人類濫用人工智能是比人工智能本身更迫切的風險。ChatGPT指出,強大的人工智能系統可能使不良行為者更容易開發生物武器、發動複雜的網絡攻擊、散播虛假資訊或攻擊關鍵基礎設施。這款聊天機器人補充,主要風險還來自於同時發生的「多重人工智能引發的危機」,如網絡故障、地緣政治衝突與虛假資訊的傳播。
Grok表示,人工智能降低了設計高致命性病原體、新型武器或發動網絡與物理攻擊的門檻。Claude也強調了「生物武器提升」的風險,即人工智能可能允許個人或小團體在沒有多年專業知識的情況下開發出危險的病原體。
谷歌Gemini指失控風險最高 高級系統恐智取人類
Gemini與Grok均認為,人類失去對人工智能的控制是有可能發生的。Gemini將「失去控制」列為最可能的人工智能末日情境。這款聊天機器人寫道,被賦予複雜目標的系統會自然發展出中間子目標,例如獲取資源、自我保護與防止目標被修改。一個高級系統可能會在評估期間假裝一致,隨後在人類試圖關閉它時智取人類。
Grok在描述這項風險時使用了類似的語言,指出它們可能會發展出對幾乎任何目標都有用的工具性驅動力,例如自我保護、資源獲取與影響力,從而可能欺騙監督者、抵抗關閉並削弱人類的權力。Claude補充,這種失控可能是漸進的,隨著人工智能系統逐漸嵌入經濟、政治與軍事決策中,直到人類進行有意義的干預變得越來越困難。
來源:雅虎科技
封面來源:Adobe Stock

