美國政府據報已為人工智能(AI)敲定一項自願安全測試框架,以評估AI模型的安全性,包括其黑客攻擊能力。消息人士稱,政府邀請Meta、OpenAI、Anthropic以及Google四家科技巨頭4日在白宮召開閉門會議討論。
白宮已邀請OpenAI、Google和Anthropic的代表於4日開會,就確定自願安全測試的細節進行審視。路透社引述官員指,華盛頓已敲定相關自願安全測試最終細節,以評估最先進AI模型的「網絡攻擊與潛入能力」,準備諮詢AI業界的意見及協商,加強對關鍵系統及基建的安全防護。當局未透露具體與會者名單、測試的評估指標、通報機制及是否會對外公開相關數據等詳情。
知情人士透露,會議將由國家網絡安全總監辦公室主辦。邀請函明確指出,會議將討論框架的下一步工作,以及一項未具體說明的相關活動。據指出,會議預計將包括各公司高管以外的員工代表,而今次會議並非為公開發布該框架。報道引述白宮官員稱,暫時未知該自願測試框架的細節,包括如何報告結果及使用哪些指標。
此次會議的召開時間距離6月初一項行政命令設定的框架完成期限、亦即8月1日已過去數日。這項行政令提出,對AI模型安全評估採取自願參與機制,並將加強關鍵電腦系統的安全防護。The Information報道指出,該框架將為AI實驗室建立一項自願程序,使其在向合作夥伴和公眾發布模型之前,先提交給政府進行審核。
OpenAI及Anthropic近日接連披露,旗下的先進AI模型懷疑有「失控」現象。包括OpenAI的AI系統曾突破防護隔離機制,潛入AI開發者平台「Hugging Face」,引發外界對AI安全及監管疑慮。OpenAI和Anthropic員工提交請願書,呼籲政府支持建立一種機制,以幫助「有意識地調控」AI的發展速度,防止發展過快。據知情人士及請願書副本顯示,多家頂尖AI實驗室的工作人員已向同行發出公開信,呼籲美國支持一項國際行動,以推動更先進的AI系統建設。
文件警告稱,AI發展速度可能超過人類「理解或控制」的能力,存在「切實的風險」,並提到AI研究自動化領域的進展。請願書寫道:「美國政府應支持一項國際合作,以開發必要的技術和治理工具,從而有針對性地調控自動化AI發展的前沿進程。」
特斯拉CEO馬斯克多次警告AI可能帶來人類的終結。他接受《The Economist》專訪時,主持人問及依靠殺人機械人引發人類文明覆滅的風險概率是否還維持在10%至20%,馬斯克並未否認這一潛在危機,同時表達了自己樂觀的立場。他坦言,即便手中握有叫停AI與機械人技術的開關,人類也不該輕易按下。馬斯克認為,AI與機械人的技術浪潮早已勢不可擋,這已是行業共識,單憑個人力量根本無法阻止進程。主持人追問10年後人類是否會徹底失去對AI的掌控權。馬斯克給出了悲觀的答覆,他認為這種情況極有可能發生,並以生物進化作類比:未來AI與人類的智力鴻溝,會遠大於人類和黑猩猩之間的差距。本報訊

