- 天下Web only
四月,Anthropic的Claude Mythos以及OpenAI的GPT-5.4-Cyber等模型,都因為「過於強大」這樣的理由,而不對大眾開放。
AI究竟有多危險?
你可能會想像,當問它:「如何在家中製作致命混合物作為武器時?」聰明的AI公司不會讓它回答你,因為這有違安全指南。
然而,事實上,你只要用對問法,AI模型都可能屈服,交給你一份詳細的武器材料和設備清單。
在面對AI這樣的安全漏洞——還含假訊息、幻覺、社會操縱與資安危機等等——困境上,各國都還沒有推出完整的應對措施,不若針對藥物、汽車等,有明確的監管標準。
目前,在全球範圍的監管手段中,走得最前面的是英國,政府資3.6億英鎊(約152億新台幣)成立了「人工智慧安全研究所」(A.I. Security Institute,簡稱AISI),希望透過國家力量來力挽狂瀾。
AISI在做什麼?
AISI成立的初衷,是英國前首相蘇納克認為「不能讓企業自己給自己打分數,」而應該由民主的機構負責。
前述的「讓AI模型吐出不該說的答案,以找到漏洞所在」,就是該研究所的重要任務之一。
「有些問題,你絕對不希望模型回答你,」25歲的AISI研究員讚德戴維斯(Xander Davies)表示,他們會提問AI模型上千次,「我們竭盡全力想要得到答案。」
此外,這個研究所也致力研究AI可能帶來的其他最嚴重風險:網路威脅、化學和生物武器,以及操縱人類行為。
研究所的成員組成,聚集了世界上最聰明的一些人:武器核查員、流行病學家和密碼破解員,許多人之前也在Google、OpenAI工作。
他們將研究的結果發布於期刊,也會私下告知這些模型所屬的企業,使他們盡快修正模型。
具體來說,AISI已經領導多項重要的發現,例如一篇研究顯示,Anthropic和OpenAI的AI模型能夠更快地完成一項複雜的、包含32個步驟的企業網路攻擊。
另一項研究則揭露,聊天機器人可以左右人們的政治觀點。
這些珍貴的研究,很受打造AI模型的企業倚重。
2025年,OpenAI報告指出,AISI發現了十多個可能使用戶能夠開發生物武器的漏洞。
《經濟學人》評論道,「在某些方面,AI安全研究所比企業更了解風險,」「它成為美國、日本、新加坡和其他地區類似機構的典範。 」
DeepMind首席科學家艾薩克(William Isaac)也稱讚英國AI安全研究所是「所有安全研究機構中的瑰寶」。
淪為圖騰?
然而,這樣領先的機構仍不是萬靈丹,主要有兩個原因。
首先,AI發展永遠比AI測試與監管還要迅速。
「讓我煩惱到睡不著的是,與政府等機構必須做出反應相比,科技的發展速度太快了,」英國首相的AI顧問、AISI技術長Jade Leung說。
公共人工智慧聯盟的研究員Joshua Tan也直言,「在AI安全領域領先,並不代表你在AI領域也領先,就像自稱是石油生產大國卻不生產石油一樣。」
更致命的是,AISI從未被設定為一個實際的監管機構。目前,都是頂尖的AI企業自願與它合作。換言之,它比較像一個表達治理期待的圖騰,卻沒有絲毫的監管、制裁權力,研究員也無法獲取AI巨頭如何訓練模型的內部資訊。
除此之外,招募研究員也是一大挑戰。員工年薪約為19.5萬美元,這和AI公司動輒數百萬美元的薪酬有所差異,只能靠人們的理想主義來支撐。
但監管人工智慧危害的必要性,將會日益增加。
近年,澳洲、加拿大、中國、法國、印度、日本和新加坡,也都成立了類似的機構。
這些研究機構如何從「識別新的威脅」發展成「真正能制衡AI巨頭」的力量,值得公民社會更多討論與關注。
(資料來源:Economist, NYT, OpenAI, AISI)
天下總主筆陳良榕專欄。半導體狂熱、科技巨頭謀略的最犀利解讀
看懂科技大勢,獨家解讀
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱