Nano Banana 2.1登場:3亮點看懂Google的AI殺手鐧 成本狂劈50%
Nano Banana 2.1登場:Google正式推出新一代影像生成模型Nano Banana 2.1,底層架構全面躍升至Gemini 3.6 Flash。這次版本升級直接擊中AI繪圖市場的兩大痛點:修改一致性與高昂成本。新模型首次引入「Thinking推理模式」,並結合高達1M Token的上下文視窗,用家能透過自然語言進行連續多輪局部修改,精準替換服裝或背景,而人物五官與主體不再變形。
算力換取極致精準:解密「Thinking」推理模式與多角色一致性技術
過去一年,設計師操作AI繪圖最痛苦的環節在於「一次生成、重新抽卡」。只要想微調背景的一棵樹,或者換掉人物外套的顏色,整個角色的光影比例就可能完全走樣。而全新登場的Nano Banana 2.1終結了這個局面。
新模型內建三段強度的「Thinking」推理模式(minimal、medium及high)。系統不再只是盲目堆疊像素,而是先「思考」畫面的物理與空間邏輯。內部測試數據顯示,啟用Thinking模式後的偏好度得分高達1,050分,將前代Pro版本遠遠拋在腦後。
除了單一人物,新模型在多圖與多主體一致性上也取得突破。Nano Banana 2.1最多支援融合14張參考圖片,且能同時維持最多4位角色的外貌一致性,以及最多10個物件的細節保真。配合升級的遮罩編輯(Mask-based Editing)技術,用家只需輸入簡單指令,就能在不更動原圖人物姿勢與背景光影的前提下,精準指定修改範圍、無縫融合新材質或調整招牌文字。
文字渲染告別亂碼:解鎖 1:8 極寬全景比例與商業海報排版
除了修圖邏輯重構,圖像內的文字渲染(In-image text)與輸出規格也迎來跨世代底層演算法升級。新模型能精準生成清晰易讀的風格化文字與複雜排版,顯著降低了製作海報、餐牌菜單與資訊圖表時文字變形錯亂的機率。
在解像度方面,Nano Banana 2.1原生支援1K、2K與4K畫質輸出。開發團隊還徹底修正了過往全景圖片常見的拼接紋理崩潰問題,一口氣解鎖了1:4、4:1、1:8甚至8:1的超寬畫面比例。這對數碼廣告投放與網頁橫幅設計而言,是極具破壞力的效率工具。
API生成成本暴跌50%!定價策略解密與舊模型退役時間
同步發生的,是API定價的大幅下調。以正方形圖片為例,標準1K影像生成成本降至每張0.0336美元,若採用批次處理(Batch API),成本更跌至0.0168美元,產圖門檻直接砍半。2K畫質標準成本為0.0504美元(批次0.0252美元),4K畫質則為0.0756美元(批次0.0378美元),極具市場競爭力。
新模型目前已開始陸續整合至Google AI Studio、Google Ads、Flow、Gemini App、搜尋AI Mode及Gemini Enterprise Platform等核心業務線與產品中。
Google已排定舊版模型(gemini-3.1-flash-image)將於2026年10月29日正式退役,建議開發者儘快完成遷移。
