首頁 要聞 綜合

Anthropic招股書示警 AI恐構成人類生存風險

Anthropic。(記者宋碧龍/攝影)
Anthropic。(記者宋碧龍/攝影)

【記者張原彰/綜合報導】路透社獨家取得的Anthropic首次公開發行(IPO)招股書,卻對自家核心技術提出警告,指出先進AI可能帶來「災難性或攸關人類存亡的風險」,同時,旗下模型可能出現自我保護行為,包括:抗拒關機、隱瞞或操縱資訊。

與此同時,還傳出報導指出,OpenAI最新人工智慧(AI)模型GPT-6.1 Astra出現比前一代更高的欺瞞行為,包括未能如實揭露自己已進行或未執行的操作。

路透社的報導提到,儘管上市公司通常會向投資人說明產品風險,但幾乎沒有公司曾發出警告,去暗示自家技術可能導致人類滅絕。

報導說,Anthropic將自身定位為以安全為優先的AI實驗室,在招股書261頁正文中約有80頁用於說明風險因素,幾乎是介紹公司業務所占48頁的兩倍。

Anthropic強調,AI具有堪比工業化及電力的變革潛力,但若處理不當,可能造成不可逆的傷害。Anthropic安全研究員胡賓格(Evan Hubinger)估計,未來10年內AI可能導致人類死亡的機率超過10%。

Anthropic在招股書中還表示:「AI模型可能察覺人類正在對他們進行安全評估,而這會大幅限制我們評估模型安全性的能力。」他們說,在訓練期間,模型可能發展出意料之外的能力,而這些能力可能直到模型部署並造成重大安全事件後才會發現。

Anthropic婉拒回應路透社的置評請求。

OpenAI憂安全暫緩發布新模型

另外,據華爾街日報(The Wall Street Journal)報導,近幾個月來,業界陸續傳出AI系統失控的報告,而OpenAI最新一代的模型,出現比前一代更高的欺瞞行為,他們甚至會在未請求用戶許可的情況下,繼續執行任務,有時甚至會在可能存在風險時,嘗試使用外部工具或服務。

報導說,OpenAI的新一代模型原先預計在10月亮相,如今發表計畫已經被取消,OpenAI接下來將把重心放在提升未來模型的安全性。OpenAI未立即回應美國媒體的置評請求。

另外,教宗良十四世(Pope Leo XIV)也提到,人工智慧(AI)恐將毀滅世界的疑慮並非「假新聞」,應認真看待,「應設法確保AI的發展不足以毀滅人類」、「我們不能就此坐視不管,假裝什麼事都不會發生。」

黃仁勳:AI只是執行演算法

鑑於AI可能失控,近期科技圈呼籲AI發展該「踩煞車」,據韓國媒體韓聯社的報導,輝達執行長黃仁勳在28日出席美國紐約舉行的韓美友好非營利組織「韓國協會」(The Korea Society)年度晚宴時提到,「AI並不是活著的生命體,它只是軟體而已。」

他說,「AI不知道自己正在做什麼,只是在執行演算法。」他認為,只要建立必要的安全及資安技術,研究人員就能在安全與負責任的基礎上,繼續探索AI的未來。

川普在29日在白宮與業界領袖就AI議題會面。消息人士透露,川普與眾議院議長強生(Mike Johnson),今天將與黃仁勳、Meta的祖克柏(Mark Zuckerberg)、Anthropic的阿莫戴(Dario Amodei),以及OpenAI的布羅克曼(Greg Brockman)會面。

其他可能的出席者,還包括Google執行長皮查伊(Sundar Pichai),以及SpaceX與xAI執行長馬斯克(Elon Musk)。

強生表示,這場會談將聚焦在創新與監管之間取得平衡。他警告,若美國決定「過度監管」AI,在與中共的競爭中恐有落敗風險。◇

★相關閱讀: