週二,Google推出外界引頸期待已久的圖像生成模型Gemini 2.5 Flash Image,又稱「奈米香蕉」(nano-banana)。
用戶反應熱烈,因為這款新模型能保持畫面中角色的一致性、將多幅影像融合成一幅,並且不需要用戶寫程式,用自然語言即能修改圖像,還能更符合現實世界邏輯,不輸出令人滿頭問號的畫面。
保持角色
過往在使用其他圖像模型時,可能會碰到畫面中人像「愈改愈走鐘」的煩惱,因為先前的模型很難在每次改動環境的指令下維持人物面部的細節。
然而,進化後的Gemini 2.5 Flash Image可以在多個提示和編輯指令中,保持角色或物件的外觀。

融合多張圖像
Gemini 2.5 Flash Image可以理,解並合併多幅影像。例如將一件家飾放入房間場景中,或是修改房間牆壁的紋理。
天下總主筆陳良榕專欄。半導體狂熱、科技巨頭謀略的最犀利解讀
看懂科技大勢,獨家解讀
請查看您的信箱,我們將寄送驗證信給您,確保未來信件會送到您的信箱