Nano Banana Pro: Gemini 3 Pro 影象模型

Nano Banana Pro: Gemini 3 Pro 影象模型

Hannah Foster
67
original

Google DeepMind 釋出 Nano Banana Pro,這是 Gemini 3 Pro 的影象生成與編輯模型。官方技術細節有限,但定位明確,值得關注其在 Gemini 生態中的整合。

Google DeepMind 近日釋出了一個名為 Nano Banana Pro 的新影象模型,定位是 Gemini 3 Pro 的影象生成與編輯能力。訊息來自 DeepMind 官方部落格,標題就是 Introducing Nano Banana Pro。

Nano Banana Pro 是什麼

按照官方部落格的說法,Nano Banana Pro 是 Google DeepMind 推出的影象生成和編輯模型,歸屬於 Gemini 3 Pro 產品線。換句話說,它並不是獨立於 Gemini 體系之外的新工具,而是 Gemini 3 Pro 在影象維度上的具體實現。

  • 模型名稱:Nano Banana Pro
  • 所屬系列:Gemini 3 Pro
  • 主要能力:影象生成與編輯
  • 釋出方:Google DeepMind

為什麼值得關注

影象生成模型已經不算新鮮事,但 Google DeepMind 每次出手都會引起行業注意。這次直接掛上 Gemini 3 Pro 的名號,說明它大概率會與 Gemini 生態深度整合,而不僅僅是又一個獨立的文生圖工具。

名字裡的 Nano Banana 有點意外,不過這種偏輕鬆的產品命名在 Google 內部並不少見。官方公告裡沒有給出詳細的技術規格,比如引數量、訓練資料、具體效果對比等,所以目前能確認的資訊其實相當有限。

對使用者意味著什麼

對普通使用者來說,最直接的期待是 影象生成質量編輯可控性 能否再上一個臺階。對企業使用者而言,如果它真的接入 Gemini API,可能會成為現有影象工作流的一個新選項。

目前官方只放出了釋出訊息,實際體驗和 benchmark 結果 還未公開。想第一時間嘗試的使用者,可以多留意 Google 官方部落格以及 Gemini 應用的更新動態。

Nano Banana ProGemini 3 ProGoogle DeepMind影象生成影象編輯

分享

評論

0
0/500 字元

暫無評論

成為第一個評論的人

探索更多

相似工具

Nano Banana

Nano Banana

Nano Banana 是 Google 為 Gemini 系列模型注入的全新原生影象引擎。它不再是單純的「文字變圖片」,而是讓 AI 具備了理解物理規律和複雜指令的「思維」。無論是想要在圖片裡塞入精準的文字,還是保持同一個角色在不同場景下的樣貌,它都能交出一份高分答卷。

Midjourney

Midjourney

把抽象的文字想法,直接轉化為視覺畫面

Flux AI

Flux AI

Flux AI(也標記為 Flux, FLUX.1 或 Flux AI Image Generator)是由德國 Black Forest Labs(黑森林實驗室)開發的先進文字—影象生成平臺。它通過自然語言提示(Prompt)把你的文字描述轉換成高質量影象,支援多種模型版本以適配不同需求。

GenTube

GenTube

GenTube 是一個專注於 AI 藝術創作的線上平臺,其特色在於免費、無限次的即時影象生成,以及獨特的社交化創作體驗。使用者無需任何美術或技術背景,只要輸入文字描述,幾秒鐘內即可生成令人驚豔的 AI 圖片,並能方便地分享作品、探索他人的創意世界。這個平臺旨在降低創作門檻,讓每個人都可以將腦海中的靈感瞬間變為視覺化的藝術作品。

ImageDescribe

ImageDescribe

ImageDescribe 是一款AI驅動的圖像轉文字工具,用戶可上傳圖片或粘貼圖片URL,生成詳細描述、替代文本、OCR文字、標題、產品文案、圖像提示和視覺分析。它將多種實用輸出整合到單一工作流中,幫助創作者、營銷人員、學生、電商賣家和無障礙團隊更快理解和復用視覺內容。

Snapplings

Snapplings

Snapplings 是一款「拍照即怪獸」的收集遊戲,用手機拍下現實物體就能產生可玩生物,透過 Fuse 融合、Vault 圖鑑與排行榜持續深化玩法。

開源專案

Stable-Diffusion: 免費持續更新的AI藝術學習庫

FurkanGozukara的Stable-Diffusion倉庫為AI藝術愛好者提供了免費且持續更新的教程、課程和筆記,涵蓋從Stable Diffusion基礎到FLUX、SDXL、LoRA微調、ControlNet及DeepFake等高級技術。已有超過2700顆星,是系統學習AI視覺創作的實用資源。

Nano Banana Pro: 精選Gemini圖像生成提示詞集

Nano Banana Pro 是一個精選提示詞集合,而非模型本身,專為 Google Gemini 圖像生成設計。集合包含超過 10,000 條提示詞,附有預覽圖像,並覆蓋 16 種 UI 語言。項目主語言為 TypeScript,許可證為 Other。該項目為圖像生成愛好者提供了豐富的靈感來源。

Qwen Image Layered: 分解為獨立RGBA層

Qwen Image Layered 是由 QwenLM 團隊在 GitHub 上發布的圖像分層模型。其核心目標是將普通二維圖像在程序級分解為多個具有獨立透明度通道(RGBA)的層,使每個組件可以單獨處理,類似於專業設計軟體中的操作。該項目主要使用 Python 開發,並採用 Apache-2.0 許可證。目前(採集時)已獲得 1913 個星標。

labelme: 開源影象標註,支援多邊形與 AI 輔助

labelme 是 GitHub 上熱門的開源影象標註工具,基於 Python 實現,支援多邊形、矩形、圓、線段和點標註,並提供 AI 輔助標註能力。它廣泛應用於目標檢測、語義分割等機器學習資料集的製作,擁有超過 1.6 萬星標,適合演算法工程師與研究團隊使用。