新模型能力太危險 OpenAI隔離測試

2026 年 8 月 8 日

人工智能(AI)能力持續快速提升,也讓資安風險成為一大隱憂。OpenAI於7日表示,該公司內部測試發現,代號「Astra」的新一代AI模型已展現出高度進階的程序設計與黑客攻擊能力,甚至可能達到能自主發動復雜網路攻擊的程度,故決定暫停部分開發工作,並將模型限制在高度管控的隔離環境中進行測試。

據《工商時報》報道,除了限制開發環境,OpenAI也將強化即時監控機制,透過自動化系統追蹤模型運作過程,一旦發現模型出現危險或偏離安全規範的行為,便立即中止相關操作。OpenAI同時計劃引入外部力量進行安全測試。

Astra的開發暫停凸顯AI產業目前面臨的兩難。隨著AI模型程序設計、漏洞搜尋與網路操作能力不斷提升,業者希望加速將更強大的模型推向市場,但模型能力越強,若遭濫用或失去控制可能造成資安風險隨之升高。

OpenAI強調,這次暫停部分開發並非因為模型已造成實際資安事件,而是內部測試提前發現潛在風險後所採取的預防措施。