OpenAI新推出的影片生成AI—Sora在全球引起大量關注。在OpenAI的網站上,可以看到用新的AI模型生成的範例影片,從在雪地裡行走的長毛象,到在藍天下閱讀的人以及跳著窗沿行走的大麥町狗,看起來都栩栩如生。
OpenAI創辦人奧特曼(Sam Altman)也在社交平台X(前身為Twitter)上邀請大家下指令來測試Sora生成影片的能力,其中一個指令就包括「兩隻黃金獵犬在山上做Podcast」,而生成的影片果然就是兩隻可愛的黃金獵犬戴著耳機在山頭對著麥克風。
https://t.co/uCuhUPv51N pic.twitter.com/nej4TIwgaP
— Sam Altman (@sama) February 15, 2024
上週OpenAI發布Sora之後就引起廣泛討論。在OpenAI所開設的論壇上,就有人以「Sora可能毀了許多人的人生」為題展開討論。反對Sora的人認為,這樣的技術可能意味著攝影師、藝術家、製片商等職業生涯告終。但是也有人不這麼悲觀。一位署名為赫爾(Jim Hull)的前迪士尼動畫師就分析,現在大家對AI生成影片對產業衝擊的擔憂,與幾十年前動畫產業從2D轉為3D時的擔憂完全類似。但他強調,「只要你喜歡這樣的藝術表現形式,你就一定會找到方法適應並且持續表達自我。」
「你自我表達的能力反而會被擴大到過去無法想像的高度,」他強調。
那麼Sora到底是什麼?它現在可以做到哪些事情?以下是關於Sora的6個關鍵問題:
1. Sora如何運作?
Sora可以透過直接用文字形式下達指令。根據OpenAI的解釋,文字形式下達指令後,最長可以生成長達1分鐘的影片內容;此外,Sora模型在ChatGPT的基礎上,除了對語言有相對精確的了解,藉此透過指令產生角色,也能對實體世界中,下達指令背後關聯的背景和架構有相對正確的理解。
2. Sora採用什麼技術?
Sora採用擴散模型,能從靜態噪音(static noise)的影格開始,逐步透過去除噪音生成一則影片。OpenAI解釋,Sora是建構在之前的DALL·E 3和ChatGPT上的人工智慧技術。
3. Sora模型目前有沒有什麼缺陷?
根據OpenAI的說明,Sora對於一些實體世界運作的細節的理解還不是很完美。包括事情的前因後果之間的關聯和空間概念等。舉例來說,影片中可能一個人咬了一口餅乾,但餅乾之後卻沒有出現咬痕。
4. 一般人可以開始使用Sora了嗎?
目前Sora沒有開放一般大眾使用。OpenAI在X上解釋,「在讓Sora成為OpenAI的產品之前,我們需要採取幾項重要的安全步驟。」該公司解釋,這些步驟包括與網路仇恨言論專家、虛假訊息專家等共同測試這項新的AI模型。
5. 哪些人已經可以開始使用或測試Sora?
OpenAI表示,已經開放給紅隊演練(red teamers,網路安全演練)專家來做風險測試。並且也邀請一些設計師、製片商和視覺藝術家試用來提供建議。
6. Sora何時可以開放使用?
該公司並沒有提供明確的時間表。OpenAI也強調,在開放給一般大眾使用之前,他們除了要經歷安全演練和虛假訊息測試之外,也正在測試工具來協助偵測有誤導性的內容。理想上,未來如果開放使用之後,使用者下的指令是跟色情、暴力、仇恨、名人相關的,都會被偵測並且拒絕處理。
(資料來源:OpenAI、Euronews、WSJ、Forbes)
天下總主筆陳良榕專欄。半導體狂熱、科技巨頭謀略的最犀利解讀
看懂科技大勢,獨家解讀
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱