模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Meshy 6 发布:AI 驱动 3D 建模革命,从概念图到可打印模型仅需数小时
Meshy 正式推出 Meshy 6 版本,凭借革命性的 AI 生成能力,将 2D 概念图转化为高保真 3D 模型的时间从数天缩短至数小时。资深 3D 艺术家 Chad Hunter 的实测证明,该工具能精准捕捉复杂细节(如衣物褶皱、风化纹理),大幅降低 3D 打印门槛,让创作者从繁琐建模中解放,专注于创意本身。
Krea AI 发布 Seedance 2.0:重塑 AI 视频生成,实现全片段运动一致性与专业级镜头控制
Krea AI 正式推出其最强 AI 视频模型 Seedance 2.0,专注于解决生成视频中常见的运动不一致、镜头漂移及角色形变问题。该模型在保持全片段连贯性、精准控制相机运动以及维持角色特征稳定性方面取得突破性进展,现已面向所有付费订阅用户开放,旨在为创作者提供可直接投入生产流程的高质量视频生成能力。
WaveSpeedAI 发布音频与语音模型指南:Gemini 3.5 实时转写与 Qwen-Audio-3.0 实时功能调用深度解析
WaveSpeedAI 于 2026 年 8 月 28 日发布了全面的音频与语音模型资源指南,重点聚焦 Gemini 3.5 在实时语音应用中的转写表现、MiniMax 语音克隆 API 的工作流以及 Qwen-Audio-3.0-Realtime 的流式功能调用能力。文章深入探讨了全双工语音代理的中断处理机制、原生音频视频生成与模块化 TTS 方案的对比,以及 GPT-Live 与 GPT-Realtime-2 的技术差异,为开发者提供了从成本估算到生产级落地的完整技术参考。
Warp 发布 Warp Agent CLI:首个原生支持多代理编排与终端复用架构的命令行编码智能体
Warp 正式推出 Warp Agent CLI,一款专为重度终端开发者设计的独立命令行编码智能体。该工具基于 Warp 独特的终端基础设施构建,原生支持多代理(Multi-Agent)编排、云代理无缝切换及终端会话复用(Muxing)。它解决了现有 CLI 智能体与 Shell 集成度低、无法跨目录/远程会话保持上下文等痛点,支持在 Ghostty、VS Code 及原生终端中运行,提供从自动路由到自定义模型编排的全栈能力。
Krea AI 2.0 重磅发布 Mood Boards:从风格迁移到全维美学重构
Krea AI 正式发布 Krea 2.0,核心新增“Mood Boards(情绪板)”功能。与传统的四图风格迁移不同,Mood Boards 支持无限图片输入,利用定制 LLM 与聚类算法深度解析图像中的概念、表情及整体氛围。该功能不仅转移视觉风格,更将参考集的整体美学逻辑注入生成过程,为创作者提供前所未有的探索性创作工具。
Napkin 推出 Effects 功能:一键将图表转化为电影级视觉效果
AI 绘图工具 Napkin 正式推出 Effects 功能,允许用户在不改变图表结构和内容的前提下,将任何 Napkin 生成的视觉元素转化为写实、编辑风或素描等多种高质量美学风格。该功能旨在赋予用户像专业设计师一样的视觉控制权,让图表不仅传达信息,更通过视觉风格强化沟通意图。
Flux.1-Dev 引入 SRPO 与 LoRA 技术:CrePal 实现免费在线高质量图像生成
CrePal 平台正式集成基于 Flux.1-Dev 架构的 SRPO-LoRA 图像生成模型,通过语义相对偏好优化(SRPO)与低秩适应(LoRA)技术,显著提升生成图像的写实度、光影细节及风格可控性。该方案支持 fp8 量化加速,提供 1024×1024 及以上分辨率输出,并开放 fal.ai、Wavespeed.ai 等多平台 API 集成,为专业创作者提供零门槛的高质量生成解决方案。
AI 重塑有机化学:Bohrium 等十大工具详解机制预测与逆合成分析
本文深度解析了当前有机化学领域十大 AI 专业工具,涵盖机制分析、逆合成路线规划及光谱解析。重点介绍了 Bohrium 在文献溯源与实验证据验证中的独特优势,以及 IBM RXN、ChemAIRS 等在反应预测与路线可行性评估中的技术突破。文章强调“结构感知”是 AI 化工工具的核心,并提供了基于 SMILES 和 3D 几何的严格验证方法论。
Higgsfield 4.0 发布:AI 视频生成新范式,从剧本到电影级成片全流程自动化
Higgsfield 正式发布 Cinema Studio 4.0,彻底重构 AI 视频工作流。新工具支持从剧本解析、分镜生成到成片剪辑的全自动化流程,核心突破包括单场景生成时长提升至 30 秒、支持 1080p 分辨率输出,并引入基于情绪标签和参考图像的精细化控制机制,解决了传统 AI 视频生成缺乏叙事连贯性与角色一致性的痛点。
LTX Studio 发布私有化部署方案:解锁企业级 AI 视频模型本地运行能力
LTX Studio 正式推出针对 AI 视频模型的私有化部署(On-Premise)解决方案,旨在解决企业级应用对数据隐私与合规的严苛要求。该更新支持将 LTX-2.5、LTXV 等开源视频大模型在本地或私有云环境中运行,涵盖视频生成、音频处理及物理世界模拟三大核心场景。此举标志着 LTX 从云端 API 服务向全栈本地化基础设施的重要跨越,为需要严格数据隔离的行业提供了全新选择。
元空智能发布 Boxer 端侧模型,携手惠普推动端侧 AI 办公科研落地
元空智能于 2026 年 9 月 3 日发布自研 Boxer 端侧大模型(35B 参数),并在发布会现场与惠普签署战略合作备忘录。该模型在特定任务中表现超越 GPT-4o,配合元空 AI Work 与 AI Science 双 Agent 系统,实现了从模型、Agent 到设备的完整闭环。此次合作旨在将智能重新“长”在本地设备(如惠普 Z 系列一体机),推动 AI 在办公与科研场景的离线化、安全化落地。
Cursor 集成 Grok 4.6:长程智能体与复杂视觉任务能力全面跃升
Cursor 正式集成 SpaceXAI 最新发布的 Grok 4.6 模型。该版本在长程智能体任务、复杂视觉交互及跨代码库工作方面实现重大突破,基准测试成绩与 GPT-5.6 Sol 持平。Grok 4.6 通过强化推理训练与自主验证机制,显著提升了将宽泛创意转化为可用原型的能力,并优化了安全性校准。