模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Black Forest Labs 发布 FLUX.2-Dev:4000 万像素零微调图像生成新突破
Black Forest Labs 正式发布 FLUX.2-Dev,这是一款基于 320 亿参数的 Rectified Flow Transformer 架构的开源图像生成模型。其核心突破在于无需微调即可支持多参考图像编辑、生成高达 400 万像素的超高分辨率图像,并内置 C2PA 元数据与像素级水印以确保证明来源。该模型在保持极高真实感的同时,大幅降低了专业创作门槛,成为艺术家与开发者的新利器。
Zeabur 携手 Raycast 发布 AI 生产力指南:Mac 用户本地化部署 GPT-5 与 Claude 深度解析
Zeabur 联合 Raycast 发布深度指南,详解如何利用 Zeabur AI Hub 在 Mac 本地化部署 GPT-5、Claude 等主流模型。文章涵盖 Quick AI 快捷指令、AI Chat Presets 上下文重写、以及通过自定义 providers.yaml 实现零成本 API 集成的完整技术流程,旨在解决开发者与 Mac 用户切换上下文效率低下的痛点。
Lovable 重磅升级:App 原生集成 MCP 协议,无缝嵌入 ChatGPT 与 Claude
Lovable 正式推出 Agent 集成功能,通过 Model Context Protocol (MCP) 标准,让构建在 Lovable 上的应用可直接嵌入 ChatGPT、Claude 等主流 AI 助手。开发者无需额外开发,Lovable 自动托管并维护 MCP 服务器,确保应用逻辑与 AI 工具实时同步。此举打破了传统 App 与 AI 助手的壁垒,使业务流程自动化成为可能,大幅提升了用户在工作流中的效率。
Presentations.AI 发布全新 Starter 免费版:无限用户、无额度限制与自动品牌同步
Presentations.AI 正式推出免费 Starter 套餐,彻底打破 Prezi 等竞品的额度限制与手动配置瓶颈。该版本支持无限用户协作、无限制的 Clip-E 对话式 AI 创作,并实现基于 URL 的自动品牌同步。相比 Prezi 复杂的订阅层级与导出缺陷,Presentations.AI 提供从内容生成到干净 .pptx 导出的全链路自动化,为销售、营销及合规团队提供更具成本效益的替代方案。
Adobe Podcast 增强语音解析:AI 音频修复与 Listnr 生成式语音的差异化应用策略
Adobe Podcast Enhance Speech 凭借一键降噪能力成为 2026 年 AI 音频清理的标杆,但其本质仍是“修补”而非“生成”。本文深度对比 Adobe Podcast 与 Listnr 的核心定位:前者适用于挽救人类录制素材,后者专为规模化、多语言、可控的 AI 语音生成设计。文章解析了两者在技术原理、适用场景及工作流中的互补关系,帮助开发者与内容创作者做出最优技术选型。
Gemini Robotics 1.5:DeepMind 将 AI 智能体正式引入物理世界,开启具身智能新纪元
DeepMind 发布 Gemini Robotics 1.5,标志着 AI 智能体(AI Agents)首次具备在真实物理环境中自主执行复杂任务的能力。该版本通过强化多模态感知、动态规划与自主决策机制,解决了传统机器人缺乏通用智能的痛点,为工业运维、家庭服务及科研探索提供了全新的技术范式。
OpenArt 发布面部增强功能:一键消除 Stable Diffusion 生成的“塑料感”皮肤
OpenArt 推出针对 AI 肖像中常见“塑料皮肤”问题的解决方案。通过 Image Upscale 工具新增的面部增强功能,开发者可精细调节面部强度与创意度,重建毛孔、纹理等微观细节。该功能有效解决了生成式模型过度平滑皮肤的问题,显著提升了 AI 图像的写实度与可信度。
Rows 发布 Kahneman 架构:重塑企业级 AI 分析员思维模型
Rows 正式推出基于诺贝尔奖得主丹尼尔·卡尼曼《思考,快与慢》理论构建的'Kahneman Architecture'。该架构旨在解决当前 AI 代理在复杂企业数据分析中的逻辑断层问题,通过区分'系统 1'的直觉响应与'系统 2'的深度推理,实现了从简单任务到复杂商业决策的无缝过渡。此举标志着 AI 在电子表格领域从自动化执行向真正的智能分析跨越。
美图 AI PPT 2.0 重磅升级:虚拟试穿与电商设计 Agent 全面赋能内容创作
美图 AI PPT 于 2026 年 9 月发布重大版本更新,正式推出基于 Nano Banana Pro 与 Kling 3.0 的新一代 AI 引擎。此次升级核心聚焦于“在模上造型”(On-Model Looks)与电商设计自动化,新增虚拟试穿、背景替换及水印移除等实用工具。官方强调通过 AI Agent 将创意转化为高质量视觉内容,大幅降低内容创作者与电商商家的制作门槛,助力品牌在 2026 年营销浪潮中实现快速规模化产出。
LTX Studio 发布 Relight IC-LoRA:实现任意太阳方向的室外视频重光照
LTX Studio 最新更新推出 Relight IC-LoRA 技术,专为 LTX-2.3 模型设计,能够精准控制室外视频中的光照方向与强度。该技术通过引入新的 IC-LoRA 适配器,解决了传统视频重光照在复杂室外场景下光影不一致的难题,支持用户将任意室外视频重绘至任意太阳角度,为影视后期、虚拟制片及游戏资产制作提供了强大的物理级光照控制能力。
LTX Studio 发布视频去人与阴影 LoRA:实现‘干净餐盘’级视频修复
LTX Studio 最新推出基于 LTX-2.5 架构的‘干净餐盘’(Clean Plate)LoRA 微调模型,专为视频生成场景设计。该工具能精准移除画面中的人物与不需要的阴影,保留背景细节与光影逻辑,彻底解决视频生成中常见的‘脏盘子’问题。开发者可通过 API 或 LTX Studio 界面轻松部署,显著提升了视频内容的真实感与可用性。
可灵 AI 2026 年发布 IMAGE 3.0 与 VIDEO 3.0 Omni:重塑专业级面部替换与多参考控制
可灵 AI 于 2026 年 8 月重磅推出 IMAGE 3.0 与 VIDEO 3.0 Omni 模型,旨在解决传统 AI 面部替换中光影不自然、动作僵硬及多视角一致性差的问题。新工具支持多参考控制(Multi-reference Control),能够精准处理遮挡、复杂角度及动态场景,为影视预演、角色测试及商业内容创作提供专业级解决方案。