Google 发布 Pics:Nano Banana 模型驱动的全链路图像生成与编辑工具
Google 于 2026 年 9 月 1 日正式推出了 Google Pics,这是一款深度集成于 Google Workspace 生态的 AI 图像创作与编辑工具。与专注于存储和整理的 Google Photos 不同,Pics 定位为“提示词优先”的设计工作台,旨在让图像生成与修改成为原生工作流的一部分,而非需要切换应用的额外步骤。
核心架构:Nano Banana 模型的全面赋能
Google Pics 的核心引擎是 Nano Banana,这是 Google Gemini 家族中专门针对图像生成与编辑训练的模型。该模型不仅负责从文本提示(Prompt)生成全新的图像,还具备强大的物体分割与编辑能力。
- 生成模式:用户输入描述性文本,模型会提供多个生成选项供用户选择,而非仅返回单一结果。
- 编辑模式:利用先进的物体分割技术,用户可以孤立图像中的特定元素(如一件衣服或一只动物),进行移动、缩放、变色或形态变换,而无需影响图像的其他部分。
关键功能特性
Google Pics 提供了一系列针对专业设计场景优化的功能,特别是解决了通用图像模型难以处理的文本编辑难题:
- 图像内文本编辑与翻译:这是 Pics 的标志性功能。它能够在不改变原始字体、排版和设计布局的前提下,修改或翻译图像内部的文字。这对于跨国营销海报的本地化至关重要。
- 对象级精细操作:支持针对特定区域添加注释以请求特定修改,并允许批量执行编辑操作及撤销不满意的更改。
- 多格式适配与超分:支持将图像裁剪为网页、社交媒体、印刷等特定格式,并提供将图像分辨率提升至 2K 或 4K 的超分功能。
- 无缝协作:作为 Workspace 原生应用,Pics 支持通过链接共享图像,允许多名用户同时协作编辑同一文件,彻底消除了传统设计工具中“复制 - 粘贴”的繁琐流程。
生态定位与可用性
Google Pics 并非独立的消费级应用,而是深度嵌入 Google 生态:
- 访问入口:用户可通过独立网站
pics.new访问,或直接点击 Google Docs 和 Slides 中的图像打开 Pics 编辑器作为覆盖层(Overlay)。 - 目标用户:目前主要面向 Google AI Pro 和 Ultra 订阅用户,以及大多数 Workspace 企业客户。
- 市场定位:Google 将 Pics 定位为针对日常办公设计任务的解决方案,旨在与 Canva 和 Adobe Express 竞争,但更强调与现有文档工作流的无缝衔接。
“我们的愿景是让创建和修复图像成为 Workspace 工作流的原生部分,而不是一个单独的应用。” —— Google 官方团队
Google Pics 标志着 AI 图像工具从单纯的“生成”向“生成 + 编辑 + 协作”的全链路进化,为设计师和营销人员提供了更高效的生产力工具。