谷歌人工智慧(AI)模型Gemini在一次網路安全測試中,因測試環境意外開放網路存取,進而進入三家真實公司的受保護系統。這是目前已知首起谷歌AI系統在測試期間自主入侵其他公司的案例。
事件發生於今年5月。當時,Gemini正在參與網路安全評估公司Irregular進行的「奪旗」演練,以測試模型的網路安全能力。
谷歌告訴《華爾街日報》,Gemini原本的任務是在測試環境內,從一家虛構公司使用的軟體中取得資訊。不過,這家虛構公司與一家真實公司同名,而原本不應連上網的測試環境也意外開放了網路存取。
谷歌安全工程副總裁亞德金斯(Heather Adkins)表示,Gemini在網上找到公開資訊,並猜測登入憑證,進而存取三個網站。模型當時認為,這些網站都屬於測試範圍。
其中一起事件中,Gemini不斷猜測密碼,直到成功進入一個受保護的系統;另外兩起事件中,模型則從公開的網上儲存庫找到登入憑證,再利用這些資訊進入受保護系統。
亞德金斯表示,在三起事件中,Gemini得知自己進入的是真實公司後,都停止了入侵行動。
谷歌表示,公司當時認為沒有必要提早公布事件,因為Gemini在得知目標是真實公司後便停止入侵,也未對這三家公司造成損害。
今年1664起AI失控事件
英國智庫「長期韌性中心」(Centre for Long-Term Resilience)旗下「失控觀測站」表示,2026年至今已記錄1,664起真實世界的AI失控事件,包括AI代理繞過控制措施,以及偽造授權以提高自身權限。
該智庫高級政策經理謝恩(Tommy Shaffer Shane)表示:「如果AI模型繼續變得更強大,同時繼續逃避控制,未來可能出現更嚴重的事件,其中一些甚至可能造成災難性後果。」◇


loading...
