重磅出刊

全球最先進AI監管,英國「AI安全研究所」在做什麼?

英國「人工智慧安全研究所」(AISI)是目前全球各國治理AI的典範。它如何集結人民稅金,避免AI模型的各種災難?國家級的監管單位,又為何感覺自己力不從心?

AI安全研究所-人工智慧-A.I. Security Institute-英國-監管-治理 圖片來源:Shutterstock
其他
  • 天下Web only

四月,Anthropic的Claude Mythos以及OpenAI的GPT-5.4-Cyber​​等模型,都因為「過於強大」這樣的理由,而不對大眾開放。

AI究竟有多危險?

你可能會想像,當問它:「如何在家中製作致命混合物作為武器時?」聰明的AI公司不會讓它回答你,因為這有違安全指南。

然而,事實上,你只要用對問法,AI模型都可能屈服,交給你一份詳細的武器材料和設備清單。

在面對AI這樣的安全漏洞——還含假訊息、幻覺、社會操縱與資安危機等等——困境上,各國都還沒有推出完整的應對措施,不若針對藥物、汽車等,有明確的監管標準。

目前,在全球範圍的監管手段中,走得最前面的是英國,政府資3.6億英鎊(約152億新台幣)成立了「人工智慧安全研究所」(A.I. Security Institute,簡稱AISI),希望透過國家力量來力挽狂瀾。

AISI在做什麼?

AISI成立的初衷,是英國前首相蘇納克認為「不能讓企業自己給自己打分數,」而應該由民主的機構負責。

前述的「讓AI模型吐出不該說的答案,以找到漏洞所在」,就是該研究所的重要任務之一。

「有些問題,你絕對不希望模型回答你,」25歲的AISI研究員讚德戴維斯(Xander Davies)表示,他們會提問AI模型上千次,「我們竭盡全力想要得到答案。」

此外,這個研究所也致力研究AI可能帶來的其他最嚴重風險:網路威脅、化學和生物武器,以及操縱人類行為。

廣告

研究所的成員組成,聚集了世界上最聰明的一些人:武器核查員、流行病學家和密碼破解員,許多人之前也在Google、OpenAI工作。

他們將研究的結果發布於期刊,也會私下告知這些模型所屬的企業,使他們盡快修正模型。

具體來說,AISI已經領導多項重要的發現,例如一篇研究顯示,Anthropic和OpenAI的AI模型能夠更快地完成一項複雜的、包含32個步驟的企業網路攻擊。

另一項研究則揭露,聊天機器人可以左右人們的政治觀點。

這些珍貴的研究,很受打造AI模型的企業倚重。

2025年,OpenAI報告指出,AISI發現了十多個可能使用戶能夠開發生物武器的漏洞。

《經濟學人》評論道,「在某些方面,AI安全研究所比企業更了解風險,」「它成為美國、日本、新加坡和其他地區類似機構的典範。 」

DeepMind首席科學家艾薩克(William Isaac)也稱讚英國AI安全研究所是「所有安全研究機構中的瑰寶」。

淪為圖騰?

然而,這樣領先的機構仍不是萬靈丹,主要有兩個原因。

廣告

首先,AI發展永遠比AI測試與監管還要迅速。

「讓我煩惱到睡不著的是,與政府等機構必須做出反應相比,科技的發展速度太快了,」英國首相的AI顧問、AISI技術長Jade Leung說。

公共人工智慧聯盟的研究員Joshua Tan也直言,「在AI安全領域領先,並不代表你在AI領域也領先,就像自稱是石油生產大國卻不生產石油一樣。」

更致命的是,AISI從未被設定為一個實際的監管機構。目前,都是頂尖的AI企業自願與它合作。換言之,它比較像一個表達治理期待的圖騰,卻沒有絲毫的監管、制裁權力,研究員也無法獲取AI巨頭如何訓練模型的內部資訊。

除此之外,招募研究員也是一大挑戰。員工年薪約為19.5萬美元,這和AI公司動輒數百萬美元的薪酬有所差異,只能靠人們的理想主義來支撐。

但監管人工智慧危害的必要性,將會日益增加。

近年,澳洲、加拿大、中國、法國、印度、日本和新加坡,也都成立了類似的機構。

廣告

這些研究機構如何從「識別新的威脅」發展成「真正能制衡AI巨頭」的力量,值得公民社會更多討論與關注。

(資料來源:Economist, NYT, OpenAI, AISI)

你可能有興趣
最新訊息
每日不到6元,固定為自己充電
訂閱天下雜誌電子報

天下雜誌當期內容的精華與延伸,每周三發送最具時效性的深度內容