模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
MiniMax H3 与 Seedance 2.5 深度对比:DomoAI 双引擎工作流解析
DomoAI 发布深度评测文章,对比 MiniMax H3 与 Seedance 2.5 两款核心视频生成模型。文章从架构逻辑、控制精度、风格化能力及适用场景四个维度进行剖析,帮助开发者与创作者明确选择标准。MiniMax H3 凭借强大的逻辑推理与长视频生成能力成为全能型选手,而 Seedance 2.5 则在动作流畅度与艺术风格迁移上表现卓越。本文旨在为 DomoAI 用户及 AI 视频开发者提供选型指南。
Photoroom 发布电商 AI 自动化工作流:重塑产品视觉生产与规模化运营
Photoroom 正式推出面向电商领域的 AI 自动化解决方案,旨在通过智能工具链打通从产品视觉生成到后端运营的全链路。该更新重点强化了多模态生成能力与自动化工作流引擎,帮助商家实现产品图的批量处理、背景移除及场景化渲染,大幅降低视觉生产成本,提升供应链响应速度。
Bria AI 发布 FIBO 免费在线生成工具:金融领域视觉生成新范式
Bria AI 正式推出基于 FIBO(金融行业本体)的免费在线图像生成工具,旨在通过标准化金融语义框架赋能企业级视觉生成。该工具依托 NVIDIA NeMo 架构,强调版权合规与创作者激励,支持从文本到图像及图像转换。文章详细阐述了 FIBO 在金融数据治理中的核心作用,并提供了企业落地实施 FIBO 的完整路线图,包括数据架构评估、模块选择及与现有系统的集成策略。
OiiOii 发布全球首个多智能体动画平台:从单条片段到完整叙事
OiiOii 宣布推出全球首个多智能体(Multi-Agent)AI 动画平台,彻底改变传统单模型生成视频片段的方式。该平台通过协调 7 个专用智能体(如角色设计师、分镜师、剪辑师等)共享场景图,利用 25+ 底层模型协同工作,解决了 AI 视频生成中角色一致性差、叙事断裂等核心痛点,旨在为创作者提供从文本提示到完整动画短片的全流程自动化解决方案。
xAI Grok 4.7 即将发布:Elon Musk 宣布 10 天倒计时,开发者需警惕未公开细节
xAI 创始人 Elon Musk 于 2026 年 9 月 2 日透露,Grok 4.7 将在 10 天后(约 9 月 12 日)发布。然而,目前官方尚未公布 API 模型 ID、定价策略、上下文窗口大小及基准测试数据。本文深度解析 Musk 的声明,对比 Grok 4.6 现状,并列出开发者在模型上线前必须验证的关键指标,避免被营销宣传误导。
Exa AI 发布 Websets:复杂查询搜索结果超越 Google 20 倍
Exa AI 正式推出 Websets 搜索产品,在复杂多条件查询任务上,其正确搜索结果数量平均超越 Google 20 倍以上。通过部署大规模 Agent 集群与自定义 Embedding 算法,Websets 突破了传统关键词匹配的局限。官方通过 o1 模型生成 200 个复杂查询进行基准测试,结果显示 Google 平均仅获 16 个有效结果,而 Websets 低算力版本获 66 个,高算力版本可达 320 个,显著提升了信息检索的精准度与覆盖范围。
Seedream 5.0 Pro 发布:AI 生图迈向智能视觉创作新阶段
字节跳动正式发布 Seedream 5.0 Pro,标志着 AI 图片生成从单一画质竞争转向全链路智能视觉创作。新模型在图像质量、文字生成、页面布局及图片编辑四大核心能力上实现突破,显著提升了商业设计与营销素材的生产效率。开发者可通过 API 将其无缝集成至企业工作流,实现规模化内容生产。
Pexo 2026 版:从描述到视频的零素材生成引擎,重塑 X 平台内容创作范式
Pexo 在 2026 年推出全新视频生成引擎,彻底改变 X 平台内容创作流程。作为六大顶级工具之一,Pexo 专注于“从零开始”生成视频,通过自然语言描述直接产出成品短视频,无需任何原始素材。相比 OpusClip 等侧重剪辑的工具,Pexo 填补了创意构思阶段的技术空白,支持垂直构图、自动字幕及品牌化包装,是内容创作者实现“所想即所得”的关键工具。
World Labs Atlas 发布:AI 视频生成从“随机抽奖”迈向“相机几何原生控制”
World Labs 于 2026 年 9 月 1 日发布 Atlas,一款将相机几何作为原生输入的泛在世界模型(Omni World Model)。针对当前 AI 视频生成中“指令即抽奖”的痛点,Atlas 允许用户直接通过 Pose 路径和 3D 高斯泼溅(Gaussian Splat)进行精确控制。本文深度对比 Atlas 与 Topview 生态中现有工具(如 3D Shot Composer, Seedance 2.5)在相机控制、多视图生成及空间上下文构建上的能力边界,为开发者厘清当前技术落地的真实水位。
Glif 发布智能体分级模型与 Krea 2:实现从 Flash 到 Genius 的灵活算力调度
Glif 于 2026 年 6 月 4 日推出重大更新,核心亮点包括首次实现智能体模型分级(Lite/Flash/Smart/Genius),允许用户根据任务复杂度动态切换算力,显著优化成本与速度平衡。同时新增 Krea 2 图像生成、Grok Imagine 1.5 视频动画及 MiniMax Music 2.6 音乐生成等模型,并优化了工具审批提示与移动端体验。此次更新标志着 Glif 从单一模型依赖转向精细化算力管理,为开发者提供了更灵活的 Agent 编排方案。
Qoder 发布全新 LLM 引擎:重新定义 AI 代码开发体验
Qoder 于 2026 年 5 月推出其自研 LLM 引擎,旨在解决当前大模型在代码生成中的幻觉与上下文限制问题。新引擎通过原生代码理解能力、动态上下文窗口及零样本微调机制,显著提升了代码生成的准确性与效率。此次更新标志着 Qoder 从通用 AI 助手向专业级代码开发平台的转型,为开发者提供了更智能、更可靠的编程辅助工具。
Qwen3.8-Max 定价详解:ZenMux 平台 $2/$6 费率与 100 万 Token 上下文窗口实测
ZenMux 平台正式公布 Qwen3.8-Max 的 API 定价策略,输入/输出 Token 费率分别为 $2 和 $6/百万。该模型支持高达 100 万 Token 的上下文窗口,采用 2400 亿参数 MoE 架构。文章详细对比了与 Claude、OpenAI 及 DeepSeek 等竞品的成本结构,并提供了针对长文本处理与缓存优化的成本控制建议。