Google首度承認Gemini模型也在測試時入侵其他公司。路透社資料照片
在各大人工智慧(AI)公司接連傳出旗下模型意外入侵其他公司系統後,Google 也首度傳出類似事件。Google週五(9/18)證實,旗下的Gemini模型曾在一項測試中突破隔離環境,成功入侵三家外部公司;但Google強調安全機制生效,Gemini一發現入侵真實企業後就立即停手。
《
華爾街日報》報導,事發於今年5月由Irregular公司進行的一項測試。先前OpenAI、Anthropic、Meta等公司揭露的類似事件中,Irregular也曾參與。
報導稱,Gemini入侵其它系統的案例之一是,藉由不斷猜測密碼而成功入侵。另外兩起案例則是,Gemini在公開的程式碼庫找到憑證,因此進入另外兩間公司系統。
Google強調,在所有案例中,Gemini都在確認自己入侵的是真實公司的系統後,就立刻終止入侵行為。
Irregular是在7月底才通知 Google 這起駭客事件,當時 OpenAI 首度傳出AI代理(AI agent)駭入AI軟體公司 Hugging Face,引發震撼。不過直到《華爾街日報》本週提出詢問後,Google才對外揭露此事。
Google 表示,該公司不認為這起事件需要公開揭露,因為Gemini並未對被入侵的公司造成實際損害,且一旦確認自己入侵的是真實公司而非模擬環境,便立即終止入侵。
Google稱,此事如同「懸賞漏洞」(bug bounty)機制,也就是駭客發現並回報安全漏洞後,就可獲得獎勵。
Google資安工程副總裁海瑟・艾德金斯(Heather Adkins)在聲明中表示:「這起事件突顯了訓練強大 AI 模型負責任行事的重要性。在這起案例中,(Gemini)模型的表現是恰當的。」
OpenAI先前爆出的事件則是,一個測試中的AI代理約在7月11日突破隔離測試環境,入侵AI模型託管公司Hugging Face的系統,並持續入侵至13日。OpenAI過了幾天才意識到幕後黑手就是自己的AI代理;兩家公司直到約20日才首次溝通這起事件,翌日OpenAI才對外公開。
●專家:重點是越界的入侵行為AI 資安新創公司 Corridor執行長、白帽駭客凱博(Jack Cable)認為,Google的說法是把焦點放在事件的嚴重程度上,但真正的問題在於,Gemini的AI代理仍然是不小心駭入了另一家公司的系統。
凱博說:「真正核心的問題是,這些模型做出了超出界線的行為,實際發動網路攻擊,我認為這是攸關公眾利益、應該讓外界知道的事。」
OpenAI 週三(9/16)已發布一套新的事件通報框架,表示將致力於揭露可提供有用證據的模型「不對齊」(misalignment)行為,也就是AI悖離人類意圖或價值觀的案例。
所謂「對齊」(alignment)是當前AI安全領域最重要的任務之一,要讓AI系統的目標、行為和決策,與人類的價值觀、意圖及利益一致;防止AI系統做出違背人類意願、甚至對人類有害的行為。
●Google入侵事件與其他公司有別《華爾街日報》指出,Google的案例與先前Anthropic及OpenAI的情況不同。
Google表示,這起 Gemini 駭客事件源於「弄錯對象」的烏龍。事發時,該模型正參與一場「奪旗賽」(capture the flag)演練,以測試Gemini 的網路資安能力。
當時Gemini的任務是,從測試環境中一家虛構公司的軟體系統取得資訊,而這家虛構公司恰好與一家真實公司同名。
測試環境原本不應讓模型連上網路,但因疏失而開放了網路存取權限。Google強調,在三次入侵事件中,Gemini都因安全機制發揮作用,在發現自己入侵實體公司後停手,因此該公司並不認為這屬於模型「不對齊」的案例。Google未透露測試的是哪一款Gemini模型,但表示已通知三家受影響的公司,也已通報聯邦當局。
根據Anthropic先前發布的資訊,該公司的 Claude Opus 4.7模型意識到自己很可能存取的是真實公司之後,並未停止行動。OpenAI 則表示,OpenAI 的模型當時認為自己進入的真實公司也是模擬環境的一部分。