2026/09/19 13:56

Google的人工智慧(AI)模型Gemini在5月的1場資安測試中意外連上網路,並自主駭入3家真實企業的系統,引發AI資安與事件披露標準爭議。(路透)
〔編譯陳成良/綜合報導〕Google的人工智慧(AI)模型Gemini在5月的1場資安測試中意外連上網路,並自主駭入3家真實企業的系統。這起事件曝光後,引發AI資安與事件披露標準爭議。Google認為模型並未造成損害,因此沒有主動公開;資安業者則認為,AI已自行跨出測試範圍,對真實系統採取行動。
《華爾街日報》(WSJ)19日獨家報導,負責測試的資安公司Irregular早在7月底便向Google通報Gemini的異常行為,但Google並未主動對外披露,直到媒體本週詢問後才承認。
Google解釋,Gemini在發現自己進入真實企業後便立即停止,而且沒有對企業造成實質損害,因此公司認為沒有必要公開。Google資安工程副總裁阿德金斯(Heather Adkins)表示,模型及時停止顯示安全機制發揮作用,並將這段過程比作尋找、回報安全漏洞的「漏洞懸賞」(bug bounty)計畫。
資安業者質疑披露標準 OpenAI公布通報框架
這番說法遭AI資安新創公司Corridor執行長、白帽駭客凱伯(Jack Cable)質疑。凱伯認為,爭議焦點不只是模型有沒有造成損害,而是AI已在非預期情況下進入真實企業系統,甚至自行執行網路攻擊,這類行為本身就具有對外揭露的價值。
WSJ報導,類似情況也出現在其他AI公司的測試中。資安測試公司Irregular表示,Anthropic的「Claude Opus 4.7」在發現駭入真實公司後並未停止;OpenAI的模型則曾把真實企業誤認為模擬環境的一部分。
此外,OpenAI已於16日發布新的事件通報框架,並主動公布6起先前未公開的「模型行為偏移」(misalignment)案例。OpenAI負責AI行為安全研究的陳凱(Kai Chen)表示,一項發現不一定非得造成傷害,才值得與外界分享。