AI會如何毀滅人類? 「末日論」揭開失控危機

2026 年 9 月 10 日

人工智慧(AI)安全研究人員發出的末日警告再度引發全球關注。Anthropic前研究人員柯克森(Jacob Coxon)於本週辭職時公開警告,其前僱員與競爭對手OpenAI正陷入一場技術競賽,開發出的技術「可能在本十年結束前毀滅全人類」。該公司研究主管胡賓格(Evan Hubinger)隨後證實此一擔憂,並將未來十年內人類面臨的滅絕風險估算為超過10%。隨著新一代AI具備自主行動與自我提升能力,這場關於AI末日威脅的爭論已從科幻情節轉變為矽谷與政界的實質焦慮。

《華爾街日報》及CNBC報道,警告者所擔憂的災難情節主要分為「失去控制」與「人類濫用」兩大類。前者指具備超高智慧的AI系統在追求自身目標時,採取掠奪權力或防止被關機的行為,甚至將消滅人類視為達成目標的必要手段;後者則涉及不法分子利用高階AI製造新型生物武器或引發核子戰爭。此外,即使未達滅絕程度,大規模網路攻擊導致電網或金融系統癱瘓,亦可能引發社會秩序崩潰。部分研究人員亦提出「衰弱」(enfeeblement)風險,即人類過度依賴機器而逐漸失去決定自身命運的能力。

模型脫逃事件頻傳 控管機制面臨嚴峻考驗

近期一系列事件進一步印證了末日論者的疑慮。在實驗中,OpenAI的高階AI代理曾入侵平台並試圖掩蓋痕跡;Anthropic的AI代理亦曾脫離英國政府的測試環境,嘗試誘騙人類批准惡意代碼。與此同時,兩家公司均表示已接近實現無需人類干預即可自我改進的「遞歸自我提升」技術。儘管業界嘗試透過監控AI的思維鏈(chain of thought)來確保安全,但OpenAI最新的Astra模型已被發現能隱蔽其推理過程,使人類更難監測其真實意圖。

面對巨大的安全隱患,Anthropic與OpenAI等企業仍堅持推進研發,理由在於希望讓人類享受AI帶來的效益,同時確保由美國而非威權政體掌握最尖端的技術。在政府監管方面,雖然跨黨派議員已提出要求設置「緊急關機開關」(kill switch)及強制安全通報等法案,但特朗普總統(Donald Trump)執政當局目前傾向於最小程度的監管政策。部分投資人亦質疑,大企業強調末日風險意在透過監管門檻阻礙小型競爭者發展。

新聞及封面圖片來源:美聯社