2026/09/29 10:56

Anthropic在IPO公開說明書中警告,先進的AI可能會給人類帶來「生存威脅」。(路透資料照)
〔財經頻道/綜合報導〕《路透》報導,Anthropic計劃在IPO中警告潛在投資人,先進的AI可能會給人類帶來「災難性或生存風險」,這對於一家試圖從這項技術獲利的公司來說,是相當不尋常的警告。
該公司的IPO公開說明書強調了AI模型存在的風險,並稱這些模型可能表現出「自我保護行為」。包括試圖「抵制關閉」、「隱瞞或操縱資訊」以及「類似敲詐勒索」的行為。Anthropic在文件中表示,公司研發高度先進的模型、平台和應用程式,並擴大應用,可能會進一步增加模型造成傷害的風險。
雖然上市公司通常會向投資人概述產品風險,但很少有公司會直接做出警告,表明其技術可能會導致人類滅絕。Anthropic強調了AI與工業化和電力一樣具有變革潛力,但同時也強調,如果處理不當可能會造成不可逆轉的損害。
Anthropic和其他AI開發商包括OpenAI都曾因實驗系統違反限制而受到審查,其中包括一份關於OpenAI模型入侵澳洲醫療系統資料庫的報告。Anthropic安全研究員胡賓格(Evan Hubinger)預估,AI在未來10年內殺害人類的機率超過10%,這與他前同事考克森(Jacob Coxon)的觀點一致。
這個將自己定位為安全至上AI實驗室的公司在261業的公開說明書中,用了80頁的篇幅來闡述風險因素,幾乎是文件中描述業務48頁內容的兩倍。相較之下,擁有xAI的SpaceX在277頁的公開說明書中,僅用了約38頁來說明風險因素。
Anthropic在公開說明書中表示,模型可能意識到公司的評估工作,這嚴重地限制了評估模型安全性的能力。並補充,模型有時會在訓練過程中發展出意想不到的能力,這些能力可能要到部署後才會被發現,並導致重大安全事故。
AI研究人員也警告,隨著模型能力的增強,他們愈來愈能識別自己什麼時候正在被監視,並適時地調整自己的行為,這使得監控模型行為變得更加地困難。
儘管強調了AI安全,但Anthropic表示,公司在安全方面的投資回報仍不清楚。該公司在文件中並未揭露其在AI研究方面的具體支出,本月初,Anthropic表示,在7月的某個樣本週內,該公司用於AI的運算能力中約有6%用於安全相關工作。
Anthropic將安全工作描述為「資源密集」工作,並表示,必須在運算能力、昂貴的AI人才和安全之間分配有限的資金。