人工智慧(AI)安全爭議持續升溫。著名AI初創公司Anthropic與OpenAI的前後任研究員相繼發出嚴肅警告,指出AI在未來十年內毀滅人類的機率已超過10%。隨後數名AI巨頭異口同聲拋出「放緩」腳步的提議。
隨著內部吹哨人離職揭露業界惡性競爭,各界正密切關注「超級智慧」帶來的生存危機與「對齊」(Alignment)難題。
「對齊」問題是指人類給予AI一個目標,但忘記設定足夠嚴謹的倫理限制,使得AI可能會採取極端、非意圖的手法去達成目標。
Anthropic負責研究未來AI系統導引與控制的主管胡賓格(Evan Hubinger)9月8日公開表示,他個人認為AI在未來十年內有超過10%的概率「毀滅全人類」。
此前,該公司研究員考克森(Jacob Coxon)指責公司行為不負責任,並宣布辭職。
考克森9月6日在X平台上發表的離職聲明長文中寫道,「構建AI的人真心認為,它可能會在未來十年內毀滅我們所有人。我今天從Anthropic辭職了。過去三年裡,我在OpenAI和Anthropic從事預訓練研究。兩家公司的行為都不負責任。他們正在直接衝向自我提升的超級智慧,拿我們的生命做賭注。」
考克森也指出,雖然Anthropic的科學家能清晰認識到技術風險,但因擔憂其他不負責任的對手率先解鎖AI的危險能力,由此陷入「不得不搶先一步」的困境。
胡賓格坦言,雖然當前模型的安全風險較低,但面對藉由「自我改進」產生的超級智慧,業界至今仍未找到有效的「對齊」解決方案,也沒有走上解決問題的正軌。
胡賓格明確劃分了「當前模型」與「未來超級智慧」的區別,強調當前AI風險可控,核心威脅來自於AI具備自我改進能力後的不可控加速擴大的能力。
針對相關指控與回應,福斯財經頻道(FOX Business)已向考克森、胡賓格以及Anthropic與OpenAI兩家公司尋求置評。
AI產業的公關與行銷策略
這場風暴的核心,在於AI的「自我改進」技術以及潛在的商業動機。首先,AI持續修改自身源始碼或訓練方法的技術,可能迅速催生出具備駭客攻擊能力、能在各領域取得實際資源與權力的超人系統。
此外,AI產業歷來以提升用戶參與度、搶占市場占有率和追求銷售成長為名,需要不斷推出新產品。
考克森建議,為防止全球軍備競賽引發澈底災難,世界各國可能需要採取高昂代價的行動,例如暫時禁止提高AI模型的基礎能力。
部分外部專家如聯合國AI顧問、計算機科學家霍爾(Wendy Hall)對此類警告表示震驚,但也質疑部分言論可能帶有「公關與行銷策略」成分,因為Anthropic和OpenAI正在爭相準備迎來倍受期待的公開上市(IPO)。
阿莫戴提議「放緩」腳步
在考克斯的離職事件後,9月12日,Anthropic執行長阿莫戴(Dario Amodei)發表文章,提出應放慢前沿AI模型能力提升的速度,為安全測試、模型對齊與外部審核爭取時間。
這個看法馬上得到OpenAI執行長阿特曼(Sam Altman)及xAI執行長馬斯克(Elon Musk)的認同。
這三位目前各據山頭的AI巨頭,實際上都與OpenAI有淵源。馬斯克與阿特曼都是OpenAI的出資者,但兩人對於公司要賺錢還是「公益組織」的看法分歧,後來馬斯克退出經營。阿莫戴原在谷歌服務,2016年加入OpenAI,2000年以阿特曼不重視產品安全為由及一些人事糾紛,帶領一批工程師另外創立Anthropic。現在正值OpenAI和Anthropic上市前的準備期,AI的安全性成為市場高度關注的話題。
在考克斯拋出模型「自我改進」可能不受控的言論後,阿莫戴立即提出「放緩」開發的提議,且罕見得到其他兩位巨頭的一致認同。
「放緩」不等於停止研發
阿莫戴主張,必須放慢AI模型能力提升的速度,為安全、對齊、測試與外部審核有時間跟上。
他補充,「需要明確的是,放慢節奏並不意味著停止模型訓練或技術進步,而是確保各公司有足夠的時間來調整和保護其模型,並由第三方評估機構確認這一點」,避免在商業競爭與地緣政治壓力下,出現不顧風險的「逐底競賽」。
阿莫戴提出三階段「前沿節奏控制」構想,首先是由每家尖端AI公司引入獨立第三方評估團隊,檢視模型安全措施、訓練流程、部署安排、對齊狀況及安全事故。
阿莫戴籲政府設定產業規則
阿莫戴提議,下一階段應由民主國家的前沿AI公司建立共同安全標準,並將模型能力與安全證據掛鉤。
他認為,最有效的方式是監管美國尖端AI公司,並呼籲美國政府為特定AI安全討論提供有限豁免或協調機制。
阿莫戴同時承認,民主國家若單方面放緩AI進展,而允許中共等威權政權不受相同約束,反而可能帶來國安風險。
他主張,美國及盟國應維持並擴大技術領先,包括限制向中國出售高性能AI晶片與先進半導體製造設備、打擊晶片走私和未經授權的模型蒸餾,並加強防止模型權重遭竊的安全措施。
阿莫戴估計,如果美國有效執行上述措施,未來3至5年可進一步拉大美國領先中國的差距,從而為民主國家的安全節奏控制爭取空間。
他補充,美中之間的全球AI協調仍值得推進,但不能天真,理所當然認定對方會遵守協議約束。
OpenAI或延後首次公開募股
針對外界關於AI導致人類滅絕機率的討論,阿特曼9月12日接受《財富》(Fortune)雜誌專訪表示:「無論是10%、8%還是6%,重點是我們所有人都有著巨大的責任,不能讓自尊心、利潤動機或其他任何事情阻礙我們。」
OpenAI財務長佛萊爾(Sarah Friar)此前透露,如果業務持續加速,公司可能在2027年甚至更早上市。但阿特曼在《財富》專訪中明確排除2026年上市的可能性,將這場倍受關注的首次公開募股延後到至少2027年。
阿特曼還呼應阿莫戴的倡議說,OpenAI即將與Anthropic等競爭對手達成安全協議,承諾引入擁有員工級權限的第三方獨立評估人員,以落實安全驗證。◇


loading...
