谷歌DeepMind於10月6日公佈圖像生成與編輯模型Nano 香蕉 2.1的模型卡。該模型屬於Gemini 3系列,基於Gemini 3.6 Flash,可理解文本和圖像輸入,上下文窗口最高100萬token,輸出圖像約4K token、文本最高64K token,並通過Gemini API、AI Studio及企業平臺分發。
官方評測顯示,開啓思考模式後,文生圖總體偏好Elo爲1050,高於前代Nano Banana 2的990和Nano 香蕉 Pro的935;信息圖事實性得分0.521,也明顯高於前代的0.179和Pro的0.265。
編輯方面,多角色一致性達1106,通用編輯、蒙版塗鴉編輯和風格化同樣領先。模型適合高精度出圖與反覆修改、海報及複雜圖表文字、多語言本地化渲染。當然,該模型也存在侷限性——包括但不限於小字易模糊、角色一致性不總穩定、空間左右偶發混淆,以及世界知識和三維推理仍有限。
知識截止主要爲2026年3月,部分領域仍停在2025年1月。
![]()
![]()
![]()
![]()
![]()
更多遊戲資訊請關註:電玩幫遊戲資訊專區
電玩幫圖文攻略 www.vgover.com
