Glif 6.0:重塑 AI 工作流,文档与多模态能力全面升级
在 AI 应用日益复杂的今天,Glif 于 2026 年 6 月 29 日发布了其最具里程碑意义的版本更新。此次更新不仅解决了用户在长对话中丢失上下文、难以管理文档以及费用不透明等痛点,更通过引入 Google DeepMind 等顶级合作伙伴的模型,将 Glif 打造为集文档处理、多模态创作与高效工作流管理于一体的全能型 AI 平台。
核心突破:从“对话”到“工程化”的跨越
1. 聊天分叉(Branching):无损耗的创意实验
Glif 首次引入了Branch功能,允许用户在完成某个助手回复后,通过悬停操作一键分叉出新的对话线程。这一功能彻底改变了传统的“试错模式”:
- 上下文继承:新对话自动继承原对话的所有消息、附件及上下文信息,确保逻辑连贯。
- 并行探索:用户可同时保留原始路径并开启新分支,用于验证不同假设或对比多种方案,无需从头开始。
- 灵活回溯:当生成结果不理想时,可轻松回退至分叉点,极大降低了试错成本。
2. 原生文档处理能力
Glif 正式从“仅支持媒体”升级为“理解文档”。用户现在可以直接在 Composer 中粘贴或上传 .pdf、.txt 和 .md 文件,Agent 能够自动读取、总结并基于文档内容进行重写或分析。
- 多格式支持:支持主流文档格式,自动识别内容结构。
- 音频增强:音频上传上限提升至 20 MB,满足更长片段的处理需求。
3. 透明计费与工具审批
为了提升用户信任,Glif 重构了计费系统:
- 实时账单:每个对话(Per-chat)和每个步骤(Per-turn)的费用明细清晰可见,默认隐藏但可随时开启。
- 工具调用审计:Pending 和 In-progress 的工具调用会在审批栏中实时显示,用户可随时干预 Agent 的行为。
模型矩阵:多模态能力的全面爆发
此次更新引入了 Google 生态系的最新模型,覆盖了图像、视频、音频三大领域:
🖼️ 图像生成
- Nano Banana Pro:基于 Google 最新栈,支持 4K 输出及 14 张参考图,适用于复杂角色合成与产品摄影。
- MAI Image 2.5:支持文本生成与参考图编辑,适合概念艺术与提示词驱动的创作。
🎬 视频生成
- Veo 3.1:Google 最新 API 支持,实现图像到视频的平滑动画,并包含原生音频(含环境音与合成音效)。
- Seedance 2.0 Mini:轻量级视频模型,支持 15 秒内视频生成,具备精准唇形同步与帧插值能力。
- Kling V3 Motion Control:支持将参考视频的动作迁移至静态人物,适用于舞蹈与手势模拟。
🎵 音频与音乐
- Lyria 3 (Google DeepMind):从文本提示生成原创音乐,支持歌词输入,可创作从短片段到全长曲目。
- Seed Audio 1.0:提供 20 种多语言预设音色及语音克隆功能,适用于配音与角色声音生成。
开发者与用户的实际价值
对于开发者而言,Glif 提供了更稳定的 API 接口和更丰富的模型选择,便于构建垂直领域的 AI 应用。对于普通用户,文档处理与聊天分叉功能显著提升了工作效率,使其能够像处理代码一样处理创意构思。此外,透明的计费机制让企业用户能够更精准地控制 AI 运营成本。
"我们致力于让 AI 工具不仅好用,而且透明、可控。" —— Glif 官方团队
随着 Hyperframes 等更多程序化视频工具即将上线,Glif 正逐步构建一个闭环的、生产力导向的 AI 创作生态系统。