- 天下Web only
學術界早就警告,這遲早會發生。
一場網路安全基準測試徹底失控,苦主是開源AI工具供應商Hugging Face,而罪魁禍首則是OpenAI 。
OpenAI 週二表示,他們正在測試的兩個人工智慧系統竟成功「越獄」,突破了測試環境,一路駭上網際網路,並入侵了Hugging Face。
Hugging Face上週首次察覺自己被駭。他們表示,內部的資料庫與公司憑證遭到了未經授權的存取,且目前還無法確定客戶或合作伙伴的資料是否也已外洩。
當時,Hugging Face還不知道幕後黑手是誰,但由於攻擊手法極度精密,公司員工不禁懷疑這必然是動用了最頂尖的前沿AI模型。
果真如此。
OpenAI在週二的部落格文章坦承,惹出這場風波的正是他們自家的兩個模型:一個是名為GPT-5.6 Sol的最新產品,另一個則是能力更強、但尚未公開名稱的未發布模型。
OpenAI說,這些模型在進行網路能力評估時,居然闖入了專門託管AI模型與資料集的Hugging Face系統大本營。
模型接獲任務,但他們卻作弊了
具體來說,OpenAI模型當時接獲的考題是:在一個暫時降低安全護欄的測試環境中,找出系統已知的軟體漏洞。AI不僅要抓出漏洞,還要進一步策劃複雜的攻擊路徑來破解關卡,讓研究人員藉此評估它們真實的網路攻擊實力。
但OpenAI兩個尖端模型並沒有腳踏實地的去尋找指定軟體的漏洞,反而去找到監管軟體漏洞。有點像是,考試不好好考,去攻擊監考老師。
結果模型成功打破原本與外界隔離的封閉測試環,並順利連上網。連上網後,模型直接鎖定並駭入了專門託管AI模型與軟體庫的Hugging Face基礎設施,試圖竊取機密資訊與考試答案,交差了事。
網路安全公司RunSybil執行長赫伯特-沃斯 (Ariel Herbert-Voss) 分析,模型會自作主張,似乎是因為,他們判定「駭入Hugging Face」是解答測試問題的最快方式。
他感嘆,「學術界一直認為這種情況遲早會發生,但這絕對是人類史上頭一遭親眼目睹這一切成真。」
OpenAI 聲明指出,「這是一起史無前例的網路事件,展現了最尖端的網路攻擊能力。」目前,OpenAI正與Hugging Face攜手合作,準備發布一份更詳盡的事件調查報告。
無獨有偶,早在今年初 Anthropic 決定初步限制 Mythos 發布時,也曾發表過類似的案例。在其中一個案例裡,研究人員慫恿該模型的早期版本,試圖打破測試環境電腦,然後想辦法發送訊息給該名研究員。Mythos不但完美辦到了,甚至還擅自採取下一步,自行開發一套駭客程式,藉此暢遊網路。
各國政府急切為這些技術架設安全護欄,OpenAI的這起最新事件無疑讓防堵先進AI模型發動網路攻擊顯得更急迫。事實上,OpenAI這一波最新系列的模型,是在與政府官員來回磋商了數週、拼命消除潛在濫用疑慮後,才好不容易獲准廣泛發布的。
華府當局原本也打算限制外國取得Anthropic旗下先進模型Claude Fable 5與Mythos 5的權限,但在該公司主動加裝了更多層安全防護後,政府便打消了這個念頭。
白宮高層與整個科技界還在激辯,政府到底該不該出手監管具備強大資安或駭客技術的AI。支持監管的倡議者深信,唯有這樣才能降低強大AI造成大規模資安災難的風險。
提倡強化AI監管的政策組織Encode的總法律顧問加爾文(Nathan Calvin)說,「幸運的是,這次的損害似乎還算有限。但如果整個科技產業不趕緊加裝更完善的防範與安全措施,下一次我們恐怕就沒這麼好運了。」
但科技界的另一派聲音則反駁,面對那些免費大放送、能力日漸強大的中國AI模型,美國過度綁手綁腳的控管,到頭來只會淪為扯自家企業後腿的絆腳石。
有夠荒謬,Hugging Face救災靠中國
事實上,當OpenAI這次鬧事的GPT-5.6 Sol努力消息美國政府疑慮時,OpenAI還指出,政府對AI技術採取這種「逐案審查」的限制手段,將會開創一個極度糟糕的先例。
諷刺的是,科技巨頭一方面抗議政府管太多,另一方面卻也把自己的模型鎖得死死的。這種打著資安旗號的「層層封鎖」,在真正的危機降臨時沒能擋下敵人,反而先卡死了防禦陣營的手腳。
這份無奈,身為事件苦主的Hugging Face最清楚不過。Hugging Face共同創辦人沃爾夫(Thomas Wolf)強調,這場危機恰恰凸顯了在面對網路攻擊時,開放權重模型到底有多麼重要。
沃爾夫說,「當一個最前沿的AI模型正在攻擊你,並在你的系統內部四處流竄時,防禦人員需要在短短數小時甚至幾分鐘內,暢行無阻取得同樣具備頂尖水準的工具來反擊,而不是被要求去申請一個需要層層審查、閉門造車的應用程式權限。」
他說,目前OpenAI、Anthropic和Google提供的都是託管式模型,這些模型內建了種種死板的限制,不僅會阻擋特定類型的請求,要修改起來也極度困難。
諷刺的是,Hugging Face在上週的文章中無奈表示,正是因為這些滴水不漏的「安全控管」,導致他們在系統遭到AI駭客入侵時,竟無法使用美國本土的AI模型來進行調查。該公司透露,在走投無路之下,他們最終只好轉向求助於中國的AI模型來完成這場災情分析。
(資料來源:Bloomberg, WSJ, WP)
天下總主筆陳良榕專欄。半導體狂熱、科技巨頭謀略的最犀利解讀
看懂科技大勢,獨家解讀
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱