Google 正式推出新一代圖像生成與編輯模型 Nano Banana 2.1,重點強化圖片編輯、文字繪製與主體一致性。新模型底層基於 Gemini 3.6 Flash,在維持生成速度與成本效益的同時,提升了提示詞遵循能力。過往 AI 繪圖往往需要「一次生成、重新抽卡」,新模型改為支援連續多輪局部修改,用戶透過自然語言調整服裝、背景或文字時,能精準保持人物與物體外貌不變。
首增 Thinking 推理模式 自由彈性調校生成品質
Nano Banana 2.1 同時加入不同強度的「Thinking」推理模式,提供 minimal、medium 及 high 三個等級。用戶與開發者可按任務複雜程度,於生成速度、成本及圖像品質之間權衡。內部測試顯示,啟用 Thinking 模式的 Nano Banana 2.1 偏好度得分達 1,050 分,表現超越前代 Nano Banana 2 及 Nano Banana Pro。
支援 4K 高解像度輸出 修正超寬全景圖片比例
輸出規格方面,新模型預設提供 1K 解像度,亦支援 2K 與 4K 畫質輸出。團隊修正了全景圖片拼接紋理問題,能輸出 1:4、4:1、1:8 以及 8:1 等超寬畫面比例。新模型已開始陸續整合至 Gemini 及 Google 旗下的 AI 產品中。
來源:Neowin
