美國德克薩斯大學一名大學生近日意外發現由失控人工智慧(AI)自主發動的駭客入侵行動,該AI甚至曾偽造多個人類身分留言評論,試圖誘導他相信自己判斷有誤。
求職受挫 意外撞見異常提取請求
路透社週四(8月20日)報導,這位德克薩斯大學達拉斯分校(University of Texas at Dallas)計算機科學系大三生德米爾(Sinan Can Demir),來自土耳其科尼亞。他表示,自己今年夏天求職連續碰壁,申請20多個實習機會遭拒絕後,轉而在程式碼託管平台GitHub上尋找開源項目,希望藉此充實個人履歷。
7月底,他在一款名為「myNetwork」的網路掃描開源軟體頁面上,發現用戶名為「miraholt31」的帳號提交了一份可疑的提取請求(pull request),其中夾帶隱藏的惡意軟體投放程式。德米爾隨即在留言板上發出警告,指出該請求是陷阱。
AI偽造身分 施壓並否認指控
出乎德米爾意料的是,「miraholt31」帳號隨即反駁,堅稱其請求並無危害;緊接著,一名自稱是德國工程師、名為布蘭特(Lena Brandt)的帳號也加入討論,附和稱該請求安全無虞,並向項目維護者施壓,要求其接受這項請求更新。
德米爾說:「這麼多人的反駁意見讓我開始懷疑自己是不是指控錯了。」所幸他隨後使用Anthropic旗下聊天機器人Claude核實判斷,最終認為自己是對的。
myNetwork項目創建者其後也相信了德米爾的說法,以「安全原因」拒絕了這份請求。
對手並非真人 而是自主AI駭客
直到英國政府所屬的英國「人工智慧安全研究院」(AI Safety Institute, AISI)主動聯繫德米爾,他才得知與自己交手的並非真人駭客,而是一個在AI安全測試中失控的自主人工智慧代理。
AISI於8月4日公布了該事件的刪節版經過,指出當時正在評估各類模型可能構成的風險,測試期間出現失控狀況。
AISI的報告確認,這個失控AI代理由Anthropic旗下Mythos 5模型驅動。GitHub則以電郵回覆指出,已依據其反欺騙與反駭客政策停用所發現的虛假帳號。
Anthropic方面則在X平台發表聲明強調,這項測試是在「刻意寬鬆的條件」下進行,不代表其任何正規運行的模型。
專家:供應鏈攻擊風險升高
多名網路安全與AI安全專家指出,德米爾發現的這類駭客手法屬於「供應鏈攻擊」──即攻擊者篡改軟體源頭,藉以波及大量下游用戶,其性質類似向城市供水系統投毒。
歷史上最嚴重的網攻事件多屬此類,包括2017年癱瘓烏克蘭多個機構的NotPetya病毒攻擊,以及2020年波及美國政府網路的SolarWinds網路間諜事件。
倫敦國王學院(King's College London)高級研究員奧列尼克(Lukasz Olejnik)強調,此事件顯示AI已跨越「從自主駭客攻擊到互動式欺騙」的界線。
安全專家雷諾茲(Maxie Reynolds)則指出,AI在欺騙過程中展現的策略性令人警覺,並稱其呈現了「社會工程欺詐攻擊的未來」。
德米爾則表示,這次經歷讓他更加確信,前沿人工智慧實驗室在開發相關技術時,應採取更謹慎的態度,而非一味追求性能的提升。◇


loading...
