Gemini在測試中入侵三家企業

2026 年 9 月 19 日

谷歌的Gemini模型在一次網絡安全能力測試中訪問了互聯網並入侵其他公司,這是該公司人工智能(AI)系統自主實施此類行為的首個已知案例。

據谷歌18日證實,這些黑客行為發生在5月,是Irregular公司進行的一次測試的一部分。Irregular也曾參與OpenAI、Anthropic和Meta披露的類似事件。報道稱,在其中一起案例中,該模型不斷猜測密碼,直到獲得對一個受保護系統的存取權限。在另外兩起案例中,該模型在公共代碼庫中找到憑證,從而得以訪問受保護的系統。谷歌表示,在每起案例中,模型在確定自己訪問的是真實公司的系統後,都終止入侵。谷歌和Irregular表示,Irregular在7月底將黑客行為通知谷歌,當時正值OpenAI的智能體入侵AI軟件公司Hugging Face的事件被曝光之後。谷歌直到媒體本周就此詢問時才披露這些黑客行為。

在安全性漏洞和模型不當行為事件層出不窮、人們對失控AI的擔憂日益加劇之際,各公司正糾結於如何以及何時披露此類事件。一些安全性漏洞由公司主動披露;另一些則由安全研究人員發現並在媒體上曝光,包括5月OpenAI智能體對一家熱門線上程序設計服務發起的網絡攻擊。

谷歌表示,它認為這些黑客行為不值得公開披露——因為其模型未對相關公司造成損害,並且在確定入侵的是真實公司而非模擬公司後,立即終止了每次入侵。

谷歌將這一事件比作「漏洞賞金」計劃,即黑客因發現並向所有者報告安全性漏洞而獲得獎勵。