模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Felo 集成 OpenAI GPT-6 Astra:数学难题破解与 91.5% 越狱防御率
Felo 正式集成 OpenAI 最新发布的 GPT-6 Astra 模型,标志着其搜索与推理能力的重大飞跃。此次更新不仅实现了十个开放数学问题的自动求解,还引入了首个关键级网络安全评级,并将越狱防御率提升至 91.5%。对于依赖高精度推理与强安全性的开发者而言,这是构建下一代智能代理的关键基础设施。
Felo 集成 GLM-5.3-Flash:131 万 Token 上下文与开源多模态能力全面上线
Felo 宣布正式集成 Z.ai 发布的 GLM-5.3-Flash 模型,该模型被官方称为“神秘 Ox Alpha”。此次更新带来了 1.31M 的超大上下文窗口、开源权重支持以及多模态处理能力,且完全免费供开发者试用。此次升级显著提升了 Felo Search 在长文档检索与复杂任务理解上的表现,为 AI 应用构建提供了新的基座选择。
AirBrush 发布 AI 智能人像补光技术:重塑自然肖像摄影新标准
AirBrush 于 2026 年 7 月 27 日重磅发布其核心 AI 技术突破——智能人像补光(AI Relighting)。该技术利用先进的深度学习算法,能够自动分析面部光影结构,模拟专业影棚灯光效果,为普通用户带来无需专业设备的自然质感人像。此次更新标志着 AirBrush 从基础修图工具向专业级 AI 摄影辅助平台的转型,显著提升了社交媒体内容创作效率。
Presentations.ai 2026 版发布:以 Clip-E 对话式 AI 重构商业演示,超越 Canva 与 Gamma
Presentations.ai 于 2026 年 9 月发布全新 2026 版,主打专为商业演示设计的 Clip-E 对话式 AI 协作引擎与自动化的 Brand Sync 品牌同步功能。相比 Canva 的设计优先和 Gamma 的通用输出,Presentations.ai 实现了从 PDF/URL 到结构化商业演示的端到端生成,并通过了 SOC 2 Type II 认证,成为企业级演示文稿的首选工具。
Sudowrite 2026 发布:专为浪漫小说打造的无审查 AI 写作引擎
Sudowrite 于 2026 年 7 月正式强化其 Muse 模型,成为首个专为浪漫小说及成熟题材设计的 AI 写作工具。针对通用大模型(如 ChatGPT)因内容限制而拒绝浪漫内容的痛点,Sudowrite 推出了无审查机制、支持全感官描写的 Story Bible 角色追踪系统,并引入创意滑块(Creativity Slider)以精准控制情感张力与热度等级。数据显示,使用该工具可提升写作效率 400%,显著改善浪漫题材的情感细腻度。
Rask AI 引领语音克隆 API 市场:深度解析其技术架构与商业化应用
Rask AI 凭借在语音克隆领域的突破性进展,被公认为当前市场的首选 API 解决方案。本文深度解析了 Rask 如何利用先进的 TTS 引擎、神经网络及多语言支持技术,解决内容创作中的个性化与真实感难题。文章对比了主流 API 选型标准,并重点阐述了 Rask 在精准度、口型同步及多语种适配方面的核心优势,为开发者提供了构建下一代 AI 语音产品的关键参考。
Let's Enhance 2026 评测:AI 去像素化工具实测,为何它仍是最佳画质修复选择?
Let's Enhance 发布 2026 年度 AI 去像素化(Depixelation)工具深度对比评测。测试显示,在 4 倍放大场景下,Let's Enhance 凭借 Prime 模型在面部细节、皮肤纹理及情感表达还原上表现卓越,显著优于 Topaz Photo AI 免费版及 Canva。评测揭示了不同工具在“屏幕显示”与“高清打印”场景下的适用性差异,并强调了云端处理与本地处理的技术路线之争。
DomoAI 发布 WAV 驱动口型同步技术:让音频文件直接操控虚拟人说话
DomoAI 最新技术突破展示了如何通过单一的 WAV 音频文件驱动虚拟人面部动画,实现了从原始音频到动态口型的高保真同步。该技术无需复杂的视频源或额外的人脸捕捉数据,仅需上传音频即可生成逼真的 Talking Avatar。这一创新大幅降低了 AI 数字人制作门槛,为内容创作者提供了全新的零样本(Zero-shot)动画生成方案,标志着 AI 视频生成从‘基于图像’向‘基于音频驱动’的重大范式转移。
Felo API 重磅更新:引入 GLM 5.3 Flash 与 Z.AI Ox Alpha 百万级多模态模型
Felo 平台近日宣布 API 生态重大升级,正式接入 GLM 5.3 Flash 及 Z.AI 的 Ox Alpha 模型。Ox Alpha 作为一款主打 100 万 token 上下文窗口的多模态‘潜行’模型,凭借极致的推理效率(每百万输入 token 仅需$0.015)迅速成为开发者首选。此次更新显著降低了企业级 AI 应用的部署门槛,为构建高并发、长上下文处理能力的智能应用提供了强劲动力。
Lyrics Into Song AI 发布:从文字到旋律的自动化音乐生成新范式
Lyrics Into Song AI 正式发布,利用先进的自然语言处理与音乐生成算法,将用户输入的歌词自动转化为包含旋律、和声、编曲甚至人声的完整歌曲。该工具支持多风格生成、节奏自定义及快速原型制作,旨在降低独立音乐人及创作者的门槛,实现从创意文本到成品音频的零摩擦转化。
Kimi K3 发布:2.8T 参数 MoE 架构与 100 万 Token 窗口重塑多模态开源模型格局
Kimi 团队正式发布 Kimi K3,一款基于 2.8 万亿参数 MoE 架构的开源多模态大模型。该模型具备 100 万 Token 上下文窗口,原生支持文本、图像及视频处理。在 CharXiv Reasoning 等基准测试中表现优异,推理速度较官方 API 提升 5 倍,为需要私有化部署与长文档视频分析的企业提供了高性价比的开源方案。
AirBrush 发布 CFT 技术:AI 人像重光如何打破光影真实感瓶颈
AirBrush 宣布其核心研究 Consistent Feature Transport (CFT) 已被 ECCV 2026 会议录用。该技术通过全新的训练目标,让 AI 理解光影在人脸、衣物及背景间的物理传递规律,而非简单模仿亮图。此次升级显著提升了 AI 重光 (Relighting) 的自然度,有效解决了传统算法导致的皮肤色偏、阴影错位及细节丢失问题,现已集成至移动端 App。