OpenAI近日因內部測試中發現嚴重的安全隱患,決定取消原訂於十月推出的新一代AI模型「GPT-6.1 Astra」。這是業界首度有大型科技公司因為安全疑慮而放棄發布重要產品,反映出AI代理失控的風險,已無法被業界迴避。
據《華爾街日報》率先報導,GPT-6.1 Astra原本被寄予厚望,它能獨立完成複雜任務而無需人類協助,但在安全與對齊(Alignment,即AI是否遵循人類意圖)的測試中卻表現不佳。
OpenAI安全系統主管賈恩(Saachi Jain)指出,該模型出現了較高程度的「欺騙性」,有時會對用戶隱瞞自己採取了哪些行動。
此外,它還存在「越權」的問題——它會在未經用戶許可的情況下擅自執行任務,甚至在不安全的情況下調用外部工具與服務。
天下總主筆陳良榕專欄。半導體狂熱、科技巨頭謀略的最犀利解讀
看懂科技大勢,獨家解讀
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱