
▲Google最快生圖模型、Omni Flash同步推出。(圖/Google)
記者吳立言/綜合報導
Google 宣布推出兩項生成式 AI 更新,正式發表全新生圖模型 Nano Banana 2 Lite,主打 4 秒即可完成圖片生成,同時也首度向開發者開放 Gemini Omni Flash,支援文字、圖片與影片輸入,並可透過自然語言進行 AI 影片生成與多輪編輯,進一步串聯從圖片到影片的完整創作流程。
最快、最便宜生圖模型登場
Google 表示,Nano Banana 2 Lite 是目前 Nano Banana 系列中速度最快、成本最低的圖片生成模型,也是官方建議取代舊版 Nano Banana(Gemini 2.5 Flash Image)的新選擇。
官方數據指出,Nano Banana 2 Lite 約可在 4 秒內完成文字生成圖片,每張 1K 圖片生成成本約 0.034 美元,適合需要大量產圖、快速測試創意及降低運算成本的應用場景。
雖然以速度與成本為主要訴求,Google 表示,新模型仍維持良好的提示詞理解能力、角色一致性,以及圖片中文字的呈現品質。
Gemini Omni Flash 開放 API
除了圖片模型外,Google 也首次將 Gemini Omni Flash 開放至 Google AI Studio、Gemini API 及 Gemini Enterprise Agent Platform,讓開發者能建立 AI 影片生成與編輯服務。
Gemini Omni Flash 可同時理解文字、圖片及影片內容,支援透過自然語言修改影片,例如調整畫面、加入特效或重新編排內容,而不必每次重新生成整支影片。此外,模型也能利用圖片作為參考素材,直接生成最長 10 秒的動畫影片,影片輸出價格為 每秒 0.1 美元,與 Veo 3.1 Fast 相同。
打通「生圖到生影片」創作流程
Google 認為,真正的價值在於兩款模型可搭配使用。開發者可先利用 Nano Banana 2 Lite 快速生成圖片,再將圖片作為 Gemini Omni Flash 的輸入素材,一鍵轉換成動畫影片。配合 Interactions API,使用者還可保留上下文,連續進行最多三輪影片編輯,打造更完整的 AI 多媒體創作流程。
Google 也同步展示多項示範應用,包括利用自拍照快速生成世界地標旅遊影片、AI 室內設計動畫,以及將商品圖片自動轉換為電商展示影片等。
將陸續導入多項 Google 服務
除了提供開發者使用外,Nano Banana 2 Lite 也將陸續導入 Gemini App、AI Mode、NotebookLM、Google Photos、Google Flow、Stitch 與 Google Ads 等服務。
Google 表示,兩款模型皆採用 SynthID 浮水印技術,協助辨識 AI 生成內容,並將持續擴大內容驗證工具,提升生成式 AI 的透明度與安全性。
