在圖片生成這塊,Google 可說沉寂非常久,即便之前的 Nano Banana 2 和 Nano Banana Pro 生成效果很不錯了,但跟 ChatGPT 相比,還是差了一截,這也導致越來越多人跳槽到 ChatGPT。Google 似乎終於要開始動起來,稍早突然發佈 Nano Banana 2.1 圖片生成模型,不僅比上一代 Nano Banana 還強,官方分享的測試數據也超越更高階 Pro 模型,而且價格還更便宜,透過 API 生成一張 1K 圖片只要 0.0336 美元。
目前在 Gemini 中已經可以使用。
Google 推出 Nano Banana 2.1:生圖品質與角色一致性再進化,API 生圖價格直接砍半
Google 稍早透過官方 X 帳號宣布推出 Nano Banana 2.1,同一天也在 Gemini API 正式上線,這次沒有經過預覽階段,模型代號為 gemini-nano-banana-2.1。Google 在貼文中表示,這個升級版本在各方面都超越先前的模型,其中視覺設計、遮罩修圖和主體一致性進步最明顯,生成的圖片也更自然。
Meet Nano Banana 2.1, our latest image generation and editing model 🍌 This upgraded version outperforms our previous models across the board, with notable leaps in visual design, mask-based editing, and subject consistency to help you create more natural-looking images.
— Google (@Google) October 6, 2026
從 DeepMind 公布的模型卡來看,Nano Banana 2.1 屬於 Gemini 3 系列,底層模型是 Gemini 3.6 Flash。官方把它定位成 Nano Banana 2 的接班人,維持 Flash 等級的速度與成本,同時也比 Nano Banana Pro 更省資源,因此 Pro 沒有被取代。
這次升級主要四個重點:
- 畫面品質與提示詞遵循度提升
- 多輪對話中的角色一致性更穩定
- 文字渲染和資訊圖表排版更準確
- 支援 1K、2K、4K 輸出,並改善 1:4、4:1、1:8、8:1 等超寬、超長比例在 2K、4K 下可能出現的拼接瑕疵
Google 這次大多數生成與編輯能力採用人工並排盲測,再換算成 Elo 分數,分數越高代表越常獲得評審偏好;資訊圖表正確性則另外使用 AutoRater 評估,因此分數不能直接和 Elo 比較。
在文字生成圖片的「整體偏好」項目中,Nano Banana 2.1 開啟思考模式拿到 1050 分,前一代 Nano Banana 2 是 990 分,Nano Banana Pro 則是 935 分。
在多角色一致性項目中,Nano Banana 2.1 拿到 1106 分,Nano Banana 2 是 978 分,Nano Banana Pro 是 1011 分,領先前代將近 130 分。不過單一角色一致性的進步就比較小,2.1 是 1028 分,前代 981 分,Pro 991 分。
資訊圖表部分的數據變化最大,Nano Banana 2.1 拿到 0.521,Nano Banana 2 只有 0.179,Nano Banana Pro 是 0.265,大約是前代的 2.9 倍。資訊圖表的設計分數也從 961 分進步到 1048 分。
下方是 Google 公佈的所有測試分數:
| 評測項目 | Nano Banana 2.1(思考) | Nano Banana 2.1(不思考) | Nano Banana 2 | Nano Banana Pro |
|---|---|---|---|---|
| 文生圖整體偏好 | 1050 | 1015 | 990 | 935 |
| 資訊圖表設計 | 1048 | 1001 | 961 | 912 |
| 資訊圖表正確性 | 0.521 | 0.328 | 0.179 | 0.265 |
| 一般修圖 | 1026 | 980 | 938 | 939 |
| 單一角色一致性 | 1028 | 1021 | 981 | 991 |
| 多角色一致性 | 1106 | 1068 | 978 | 1011 |
| 遮罩/塗鴉修圖 | 1049 | 1042 | 965 | 927 |
| 商品一致性 | 1024 | 981 | 955 | 965 |
| 風格轉換 | 1062 | 1036 | 991 | 990 |
| 多張參考圖編輯 | 1066 | 1041 | 988 | 989 |
那跟對手比呢?第三方盲測平台 Arena 在 10 月 6 日的文字生成圖片排行榜中,Nano Banana 2.1 以 1328 分排名第 5,是目前排名最高的 Google 模型。排在前面的依序是 OpenAI 的 GPT Image 2.5 兩個版本(1425 分、1398 分)、GPT Image 2(1383 分),以及微軟的 MAI-Image-2.6(1333 分):
當然,Nano Banana 2.1 也是有缺點。
官方也在模型卡中列出 Nano Banana 2.1 目前還做不好的地方,包括
- 小字容易模糊,在 1K 解析度下尤其明顯,長段落、整頁文字也還不穩
- 輸入圖和輸出圖之間的角色一致性不是每次都完美
- 遮罩修圖有時只照指令做了一部分;修圖時偶爾會保留原圖人物的姿勢
- 左右方向有時會搞混
- 涉及世界知識、3D 推理與事實正確性的進階能力也還有限
Google 表示 Nano Banana 2.1 從 10 月 6 日開始陸續推出到 Gemini App、Google 搜尋的 AI 模式、Google AI Studio、Google Flow、Google Stitch、Google Ads,以及企業用的 Gemini Enterprise Platform。
我測試在 Gemini 生成圖片,已經變成 Nano Banana 2.1 了:
API 方面,根據 Gemini API 官方定價頁,Nano Banana 2.1 的圖片輸出價格是每百萬 Token 30 美元,比 Nano Banana 2 的 60 美元直接砍半。
換算成每張圖,1K 是 0.0336 美元、2K 是 0.0504 美元、4K 是 0.0756 美元;用批次處理(Batch API)還能再打對折,1K 只要 0.0168 美元。簡單來說,用標準版生一張 1K 圖大概是新台幣 1 元左右。
| 項目(美元) | Nano Banana 2.1 | Nano Banana 2 | Nano Banana 2 Lite | Nano Banana Pro |
|---|---|---|---|---|
| 輸入(每百萬 Token) | 1.50 | 0.50 | 0.25 | 2.00 |
| 文字與思考輸出(每百萬 Token) | 7.50 | 3.00 | 1.50 | 12.00 |
| 0.5K 圖片(每張) | 不提供 | 0.045 | 不提供 | 不提供 |
| 1K 圖片(每張) | 0.0336 | 0.067 | 0.0336 | 0.134 |
| 2K 圖片(每張) | 0.0504 | 0.101 | 不提供 | 0.134 |
| 4K 圖片(每張) | 0.0756 | 0.151 | 不提供 | 0.24 |










