模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Murf AI 2026 语音交互引擎升级:Murf Falcon 模型实现 55ms 超低延迟
Murf AI 于 2026 年推出全新 Murf Falcon 语音大模型,专为生产级实时语音交互设计。核心突破包括将响应延迟压缩至约 55ms,支持 35 种语言及代码切换,并强化多模态 API 集成能力。此次更新标志着 Murf AI 从通用语音合成向企业级智能语音助手(Voice-First AI Agents)的战略转型,显著提升了客服、销售及 IVR 系统的实时体验。
商汤科技发布 SenseNova 大模型与 SenseFoundry 平台,构建全栈 AI 生态
商汤科技于 2020 年 7 月正式推出 SenseNova 日日新大模型与 SenseFoundry 城市/企业开放平台,旨在打造从底层基础设施到上层应用的全栈 AI 生态。此次发布涵盖自然语言处理、3D 重建、智能驾驶及联邦学习医疗等多个核心领域,标志着商汤从单一技术提供商向 AI 生态构建者的战略转型,为开发者与行业客户提供零代码/低代码的 AI 赋能方案。
Felo 发布 GPT-6 Astra:105 万上下文窗口与原生 API 支持
Felo 正式在其 OpenAPI 中集成 GPT-6 Astra 模型,带来行业领先的 1.05M 上下文窗口和 128K 最大输出长度。该模型完全兼容 Chat Completions、Responses 和 Messages 端点,为开发者提供了处理超长文档、复杂代码及多轮对话的坚实基础,标志着 Felo 在长上下文处理与 API 稳定性上的重大突破。
LensGo 发布 Iris 创意智能体:从“提示词输入框”到“一站式交付引擎”的范式转移
LensGo 正式推出 Iris 智能体,将 AI 图像生成从单一的‘提示词工具’升级为具备规划、决策与执行能力的‘创意协作伙伴’。Iris 能够理解模糊意图,自动拆解任务,智能匹配不同模型,并在用户确认前不消耗任何算力资源。这一更新解决了创作者在模型选择、提示词编写及多版本迭代中的痛点,实现了从‘操作工具’到‘简报同事’的根本性转变。
CrePal 发布 Animagine XL 4.0:840 万数据训练,重塑二次元图像生成新标准
CrePal 旗下 Animagine XL 4.0 模型基于 Stable Diffusion XL 架构,利用 7 台 H100 GPU 耗时 2650 小时,在 840 万张二次元图像上进行训练。该模型在解剖学准确性、色彩还原及提示词遵循度上实现重大突破,推出 Opt 与 Zero 两个变体,支持商业商用,为创作者提供专业级二次元绘图解决方案。
Ostris 发布 Flex.1-Alpha:80 亿参数模型突破 CFG 依赖,架构效率提升 58%
Ostris AI 正式发布 Flex.1-Alpha,基于 FLUX.1-schnell 架构重构,拥有 80 亿参数。其核心突破在于引入独特的 Guidance Embedder,彻底摆脱了传统 Classifier-Free Guidance (CFG) 的依赖,在减少 58% 计算复杂度的同时保持高质量生成。该模型采用 Rectified Flow Transformer 架构,支持 512 词上下文,采用 Apache 2.0 协议开源,为开发者提供了更高效、灵活的图像生成方案。
Photoroom 企业级 API 2026 版发布:实现电商图片处理零停机迁移
Photoroom 正式发布面向企业级的 2026 版 API 解决方案,主打无缝集成与高性能处理。该版本通过直接对接 DAM、PIM 及电商平台,解决了传统自建方案的高昂成本与运维难题。Mercari 等头部企业已验证其百万级图片月处理能力的稳定性,显著降低了企业数字化转型的门槛与周期。
GPT-4.1 重磅升级:推理、多模态与精准微调全面进化
OpenAI 正式发布 GPT-4.1,在 GPT-4 基础上实现了显著的技术飞跃。核心升级包括更精准的微调能力、增强的多模态数据处理、大幅降低幻觉率以及更长的上下文理解。此次更新特别强化了复杂逻辑推理与多步骤问题解决能力,同时优化了响应速度并扩展了语言支持,为开发者构建专业级 AI 应用提供了更可靠的基石。
Viggle 发布 Viggle-Animate:单帧重绘即可实现视频角色替换,速度提升 6 倍
Viggle 团队推出 Viggle-Animate,一款基于 MiniMax-H3 微调的视频生成模型。其核心突破在于仅需用户提供一张经过编辑的“重绘帧”(Repainted Frame)即可在视频中替换角色,无需额外的姿态估计、分割掩码或文本提示。该模型通过双教师蒸馏技术,在单一 GPU 上仅需 3 次前向传播即可在 26 秒内生成 124 帧视频,相比 Wan2.2-Animate 速度提升 6.1 倍,且在高速运动和复杂姿态下保持更高的细节保真度。
Exa AI 发布下一代搜索引擎架构:基于神经网络的“苦味法则”与全栈自研
Exa AI 正式披露其下一代搜索引擎的底层架构,核心在于摒弃传统关键词匹配,全面采用基于神经网络的“苦味法则”(Bitter Lesson)。通过自研爬虫、专用 Embedding 模型及 144 张 H200 GPU 集群,Exa 实现了从简单查询到复杂工程级需求的全覆盖,标志着搜索技术从静态索引向动态计算能力的根本性转变。
LensGo 发布 AI UGC 视频生成工作流:Seedance 2.0 驱动 TikTok 广告自动化
LensGo 依托 Seedance 2.0 模型,推出专为 TikTok 和 Meta 广告优化的 AI UGC 视频生成工作流。该工具通过内置的五种结构化广告格式(如 Hook + Demo、Unboxing 等),结合原生音频与唇形同步技术,将原本需数周的创作者视频制作缩短至 5 分钟。开发者与营销团队可通过“一键生成三版本”实现 A/B 测试,大幅降低试错成本。
北大&元空AI联合开源科研智能体 OpenAI4S,Code-as-Action 重构 AI for Science 工作流
北京大学与元空 AI 联合实验室正式开源科研智能体 OpenAI4S,采用 MIT 协议。该项目摒弃传统工具调用模式,首创 Code-as-Action(代码即行动)架构,支持在持久内核环境中直接执行 Python/R 代码,实现从数据检索、清洗到计算分析的全流程自动化。内置 30+ 科研 Skills 并支持 GPU 算力接入,严格遵循 No-Fabrication Policy,确保科研数据的真实性与可复现性。