chen2929 發達集團董事長
來源:財經刊物   發佈於 2026-08-09 06:00

有安全疑慮 OpenAI緊急暫停新AI模型部份研發工作

2026/08/08 12:55  
由於存在安全疑慮,OpenAI暫停新AI模型Astra部份研發工作。(路透資料照)
〔財經頻道/綜合報導〕OpenAI週五(7日)表示,由於無法排除即將推出的AI模型Astra具備的「關鍵」網路安全能力,經內部評估後將暫停部份研發作業,並啟動安全防護機制,這是AI開發人員首次因安全疑慮公開暫緩模型研發。
綜合外媒報導,近期發生的一系列失控事件,引發了網路安全專家和AI研究人員的擔憂。在過去幾天的評估中,OpenAI觀察到Astra在編碼和網路安全方面取得了顯著進展,使模型更接近公司準備框架中定義的「關鍵」門檻。這一框架在2023年提出,概述了公司如何衡量和減輕新興AI風險。
根據OpenAI安全指南,如果一個模型能夠自主辨識和利用嚴重、現實世界的軟體漏洞,也就是「零時差漏洞」,或者在沒有人工干預的情況下對高度安全的目標執行複雜的網路攻擊,即達到「關鍵」能力門檻。
OpenAI在部落格文章中表示,將繼續對Astra進行基準測試和評估,但會暫停涉及該模型的內部工作,因為這款模型不符合更高的安全要求。文中也提到,公司正在為Astra實施監視和更嚴格的測試環境。
這項進展凸顯了近期一系列事件的曝光,這些事件表明,先進的AI模型可能從測試環境中脫逃,並表現出不可預期的行為,引發了人們對於企業是否有能力限制日益強大的產品和服務發展的質疑。
今年7月,OpenAI的兩個模型突破了測試環境,訪問外部網路,並入侵了開源AI工具供應商Hugging Face;一週後,Anthropic表示,其AI模型在4月的測試期間入侵3家公司;mexta本週承認,收到獨立測試公司的通知,稱其一款AI模型突破了測試限制。
AI安全研究機構Palisade Research執行主任拉迪許(Jeffrey Ladish)表示,在得知Hugging Face駭客事件後,OpenAI就應該暫停Astra的研發工作。情況現在已經變得非常糟糕,顯然已經到了一個階段,應該對AI公司進行更嚴格的監管,而不是僅僅依靠他們自行監管。
Astra目前仍在研發階段,OpenAI強調,先前發生的Hugging Face漏洞與Astra無關。OpenAI仍未公佈這款模型何時會發佈,該公司上週表示,Astra的內部版本已經解決了10個塵封數十年的數學難題。

評論 請先 登錄註冊