今周刊編按:Google證實,Gemini在資安測試中自主入侵3家企業系統,再度引發外界對AI的安全疑慮。
根據《華爾街日報》報導,負責測試的資安公司Irregular早在7月底便向Google通報Gemini的異常行為,但Google並未主動對外披露,直到媒體本週詢問後才承認。
Google回應,Gemini在發現自己進入真實企業後便立即停止,而且沒有對企業造成實質損害,因此公司認為沒有必要公開。
類似情況也出現在其他AI公司的測試中。資安測試公司Irregular表示,Anthropic的「Claude Opus 4.7」在發現駭入真實公司後並未停止;OpenAI的模型則曾把真實企業誤認為模擬環境的一部分。
Alphabet旗下的谷歌(Google)人工智慧(AI)模型Gemini在進行網路安全能力測試期間連上網路,並自主駭入其他企業,創下這家科技巨擘的AI系統自主做出這類行為的首例。
路透社引述「華爾街日報」(WSJ)報導,在其中一起案例中,Gemini模型不斷猜測密碼,直到成功進入受保護的系統。
另外兩起案例中,模型則是在公開存放庫中找到憑證,進而存取受保護系統。Google表示,模型在判定進入真實企業的系統後,在每起案例中都已自行終止入侵行為。
報導指出,這幾起駭客攻擊發生在今年5月,當時正由負責網路安全評估的獨立機構Irregular進行資安測試。
Google與Irregular表示,在發現OpenAI的AI代理駭入AI軟體公司Hugging Face後,Irregular於7月底將相關駭客事件通報Google。Google直到華爾街日報本週提出詢問後才披露此事。
Irregular發言人表示,這起事件牽涉到影響其他AI實驗室的相同問題,所有相關實驗室都在7月下旬接獲通知。這名發言人說:「我們這邊所有已知的問題,幾週前都已獲得補救與解決。」
Meta、Anthropic與OpenAI先前也披露過與Irregular相關的類似事件。Meta今年8月表示,相關事件並未涉及突破「沙盒」(sandbox)限制或複雜的網路攻擊;Irregular則指出,目前正致力於制定安全執行AI網路安全評估的最佳實務規範。
隨著AI代理獲得更大的自主權,並能存取網路與電腦系統,這一連串事件引發外界質疑相關業者是否有足夠的安全防護措施。
在類似事件頻傳以及對AI失控的擔憂升溫之際,科技業者正為如何以及何時公開資安漏洞與模型脫序行為陷入兩難。
部分資安漏洞是由業者主動公開;其他則是由資安研究人員發現並經由媒體披露,包括OpenAI的AI代理5月曾針對廣受程式設計人員歡迎的線上服務發動網路攻擊。