Google 持續更新生成式 AI 產品,最新一次更新把重點放在圖片與影片創作。Google Cloud 宣布正式推出圖片模型 Nano Banana 2 Lite,與可生成與編輯影片的 Gemini Omni Flash,目標是讓企業與創作者能用更低成本、更短時間完成各種視覺內容製作,從社群貼文、廣告素材到影片剪輯,都能交由 AI 協助完成。
Google Cloud 產品管理副總裁 Michael Gerstenhaber 指出,當工具的速度能跟上靈感的步伐時,才能激發出真正的創意。他強調,本次推出的兩款模型,核心宗旨在於為開發者與企業縮短二次生成(Regeneration)的時間,並有效控制營運成本 。
Nano Banana 2 Lite主打速度 最快4秒完成一張圖片
Nano Banana 2 Lite 是 Nano Banana 系列最新圖片模型,採用 Gemini 3.1 Flash-Lite Image 模型,速度快、成本低,適合需要大量生成圖片的應用情境,例如廣告素材、社群貼文、電商商品圖或 A/B 測試。Google 表示,Nano Banana 2 Lite 最快可在 4 秒內完成一張圖片生成,同時兼顧大量請求處理能力。對需要一次產出大量素材的企業來說,有助縮短等待時間,也能更快完成不同版本的內容測試。
Gemini Omni Flash不只生影片 還能直接修改畫面內容
除了圖片模型,Google 亦同步推出處於公開預覽(Public Preview)階段的 Gemini Omni Flash 影片模型。這款全新模組有多模態(Multimodal)理解實力,能同時理解文字、圖片與影片。使用者只需輸入直覺的自然語言指令,系統即可在幾秒鐘內修改畫面中的人物特徵、抽換商品主體、甚至調整整體光線與背景風格。模型在編輯過程中,能自主維持影片畫面動態與背景音軌的流暢連貫。Google 表示,Gemini Omni Flash 還具備對真實世界的理解力與物理模擬能力,可直接在影片中生成可閱讀文字與動態圖形,讓影片編輯不再只是剪接,而是能直接透過對話完成多項修改。
價格方面,Gemini Omni Flash 採每秒影片輸出 0.10 美元計費。Google表示,這個定價,能鎖定具競爭力的影片生成成本。現階段支援公開預覽,音訊參考、影片參考、結尾畫面延續、場景延伸與更高解析度等 API 功能將於後續推出。
Google 同時為兩款模型加入 C2PA 內容憑證 (C2PA Content Credentials) 與 SynthID 隱形數位浮水印,協助辨識 AI 生成內容來源。
Adobe、WPP率先採用 Google瞄準企業AI創作市場
Google 也公布首波合作夥伴。Adobe 計畫整合 Nano Banana 2 Lite 與 Gemini Omni Flash 整合至 Firefly 平台。Adobe 資深產品總監 Matt Chotin 表示,新模型有助於縮短創作者從構想到完成作品的時間,同時保留創作自由度。廣告集團 WPP 正在整合 Gemini Omni Flash 到 WPP Open 平台,用於廣告素材在地化、商品替換與風格調整。WPP 創新長 Elav Horwitz 表示,AI 已逐漸成為品牌內容製作的重要工具。相較於提升模型規模,Google此次更著重內容生成效率與企業應用。從圖片到影片,生成速度、使用成本與編輯便利性都成為此次更新核心,也反映生成式 AI,正逐漸從模型能力轉向實際工作效率與企業應用價值。
◤音樂劇魔女宅急便◢
◤你的早餐吃對了嗎?◢




