Nano Banana Pro: Gemini 3 Pro 图像模型

Nano Banana Pro: Gemini 3 Pro 图像模型

Hannah Foster
67
original

Google DeepMind 发布 Nano Banana Pro,这是 Gemini 3 Pro 的图像生成与编辑模型。官方技术细节有限,但定位明确,值得关注其在 Gemini 生态中的整合。

Google DeepMind 近日发布了一个名为 Nano Banana Pro 的新图像模型,定位是 Gemini 3 Pro 的图像生成与编辑能力。消息来自 DeepMind 官方博客,标题就是 Introducing Nano Banana Pro。

Nano Banana Pro 是什么

按照官方博客的说法,Nano Banana Pro 是 Google DeepMind 推出的图像生成和编辑模型,归属于 Gemini 3 Pro 产品线。换句话说,它并不是独立于 Gemini 体系之外的新工具,而是 Gemini 3 Pro 在图像维度上的具体实现。

  • 模型名称:Nano Banana Pro
  • 所属系列:Gemini 3 Pro
  • 主要能力:图像生成与编辑
  • 发布方:Google DeepMind

为什么值得关注

图像生成模型已经不算新鲜事,但 Google DeepMind 每次出手都会引起行业注意。这次直接挂上 Gemini 3 Pro 的名号,说明它大概率会与 Gemini 生态深度整合,而不仅仅是又一个独立的文生图工具。

名字里的 Nano Banana 有点意外,不过这种偏轻松的产品命名在 Google 内部并不少见。官方公告里没有给出详细的技术规格,比如参数量、训练数据、具体效果对比等,所以目前能确认的信息其实相当有限。

对使用者意味着什么

对普通用户来说,最直接的期待是 图像生成质量编辑可控性 能否再上一个台阶。对企业用户而言,如果它真的接入 Gemini API,可能会成为现有图像工作流的一个新选项。

目前官方只放出了发布消息,实际体验和 benchmark 结果 还未公开。想第一时间尝试的用户,可以多留意 Google 官方博客以及 Gemini 应用的更新动态。

Nano Banana ProGemini 3 ProGoogle DeepMind图像生成图像编辑

分享

评论

0
0/500 字符

暂无评论

成为第一个评论的人

探索更多

相似工具

Nano Banana

Nano Banana

Nano Banana 是 Google 为 Gemini 系列模型注入的全新原生图像引擎。它不再是单纯的“文字变图片”,而是让 AI 具备了理解物理规律和复杂指令的“思维”。无论是想要在图片里塞入精准的文字,还是保持同一个角色在不同场景下的样貌,它都能交出一份高分答卷。

Midjourney

Midjourney

把抽象的文字想法,直接转化为视觉画面

Flux AI

Flux AI

Flux AI(也标记为 Flux, FLUX.1 或 Flux AI Image Generator)是由德国 Black Forest Labs(黑森林实验室)开发的先进文本—图像生成平台。它通过自然语言提示(Prompt)把你的文字描述转换成高质量图像,支持多种模型版本以适配不同需求。

GenTube

GenTube

GenTube 是一个专注于 AI 艺术创作的在线平台,其特色在于免费、无限次的即时图像生成,以及独特的社交化创作体验。用户无需任何美术或技术背景,只要输入文字描述,几秒钟内即可生成令人惊艳的 AI 图片,并能方便地分享作品、探索他人的创意世界。这个平台旨在降低创作门槛,让每个人都可以将脑海中的灵感瞬间变为可视化的艺术作品。

ImageDescribe

ImageDescribe

ImageDescribe 是一款 AI 驱动的图像转文字工具,用户可上传图片或粘贴图片 URL,生成详细描述、替代文本、OCR 文字、标题、产品文案、图像提示和视觉分析。它将多种实用输出整合到单一工作流中,帮助创作者、营销人员、学生、电商卖家和无障碍团队更快理解和复用视觉内容。

Snapplings

Snapplings

Snapplings 是一款「拍照即怪兽」的收集游戏,用手机拍下现实物体就能生成可玩生物,通过 Fuse 融合、Vault 图鉴与排行榜持续深化玩法。

开源项目

Stable-Diffusion:免费持续更新的 AI 艺术学习库

FurkanGozukara 的 Stable-Diffusion 仓库为 AI 艺术爱好者提供了免费且持续更新的教程、课程和笔记,涵盖从 Stable Diffusion 基础到 FLUX、SDXL、LoRA 微调、ControlNet 及 DeepFake 等高级技术。已有超过2700颗星,是系统学习 AI 视觉创作的实用资源。

Nano Banana Pro:精选 Gemini 图像生成提示词集

Nano Banana Pro 是一个精选提示词集合,而非模型本身,专为 Google Gemini 图像生成设计。集合包含超过 10,000 条提示词,附有预览图像,并覆盖 16 种 UI 语言。项目主语言为 TypeScript,许可证为 Other。该项目为图像生成爱好者提供了丰富的灵感来源。

Qwen Image Layered:分解为独立 RGBA 层

Qwen Image Layered 是由 QwenLM 团队在 GitHub 上发布的图像分层模型。其核心目标是将普通二维图像在程序级分解为多个具有独立透明度通道(RGBA)的层,使每个组件可以单独处理,类似于专业设计软件中的操作。该项目主要使用 Python 开发,并采用 Apache-2.0 许可证。目前(采集时)已获得 1913 个星标。

labelme: 开源图像标注,支持多边形与 AI 辅助

labelme 是 GitHub 上热门的开源图像标注工具,基于 Python 实现,支持多边形、矩形、圆、线段和点标注,并提供 AI 辅助标注能力。它广泛应用于目标检测、语义分割等机器学习数据集的制作,拥有超过 1.6 万星标,适合算法工程师与研究团队使用。