模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
DomoAI 发布多模态动态化引擎:让静态图像在任意设备上‘开口说话’
DomoAI 近期重磅推出新一代图像动态化解决方案,支持将静态图片转化为具有口型同步、自然运镜的短视频。该工具基于先进的 AI 视频生成模型,兼容移动端与 PC 端,核心突破在于实现了高精度的人物口型匹配与背景动态渲染。开发者可通过 API 快速集成该能力,内容创作者可一键制作Talking Head 视频,极大降低了 AI 视频内容的生产门槛。
Viggle V3 助力 Massive Studios 打造百万级病毒营销广告:角色一致性革命
Viggle V3 正式发布,成功协助 Massive Studios 打造首个病毒级 AI 广告。该广告通过 parody 苹果 1984 经典广告,推广 Sally's Pizza 与 Beckham 的辣椒酱联名。面对通用视频生成工具难以维持动态中角色与服饰一致性的痛点,Viggle V3 凭借强大的全身体动控制与视觉连贯性技术,成为核心引擎。此次合作标志着 AI 从演示走向真实商业叙事,展示了 GenAI 与传统影视制作深度融合的巨大潜力。
Felo 发布 GPT-6 Astra 模型:105 万上下文窗口与完整 API 生态升级
Felo 正式通过 OpenAPI 接口集成 GPT-6 Astra 模型,该模型具备 1.05M 上下文窗口和 128K 最大输出长度,并完全兼容 Chat Completions、Responses 及 Messages 端点。此次更新显著提升了长文档处理与复杂任务规划能力,为开发者提供了更强大的 Agent 构建基础。
CyberRealistic XL 8.0 发布:AI 生成写实人像新标杆,手眼细节突破
Cyberdelia 推出的 CyberRealistic XL 8.0 基于 SDXL 架构,专为生成高保真写实图像设计。该模型在 v7.0 基础上进一步优化,显著解决了 AI 生成中手部与眼部常见的扭曲问题,并大幅降低了显存需求。通过混合数据集训练与迭代微调,它成为目前生成高质量人像、肖像及复杂场景的可靠工具,支持 SFW 及 NSFW 内容创作。
Xiaohongshu dots-note-3.0 在 IMO 2026 斩获满分:AI 证明写作迈入新纪元
Xiaohongshu 推出的 dots-note-3.0 模型在国际数学奥林匹克(IMO)2026 比赛中首次实现完美 42/42 的官方满分成绩。该模型不仅给出了正确答案,更完成了六道难题的完整逻辑证明,涵盖代数、几何、组合数论四大领域。此次突破标志着 AI 从“答案生成”向“严谨逻辑推导”的质变,展示了其在长链条自我验证与多领域跨模态推理上的新高度。
Nafy AI 进阶指南:参数微调与提示工程实战,解锁七项隐藏创作功能
Nafy AI 发布深度创作指南,详解如何通过参数微调、提示工程及结构化提示词优化 AI 音乐生成。核心亮点包括精细控制段落结构(如 Intro/Verse/Bridge)、实现多声部合唱与说唱无缝切换、精确设定 BPM 与情感基调,并解锁了包括独奏乐器指定、和弦符号控制在内的七项隐藏功能,助力开发者与创作者从基础生成迈向专业级音乐制作。
WatermarkRemover 发布:AI 驱动的高效去水印工具,重塑图像版权与分享体验
WatermarkRemover 推出全新 AI 驱动的去水印解决方案,旨在解决传统裁剪法无法保留原图质量及水印影响专业度的痛点。该工具无需安装,支持一键上传与自动检测,承诺在去除水印的同时完美保留图像分辨率与细节。文章强调,去除水印不仅是技术操作,更是保护摄影师声誉、提升社交媒体互动率及避免版权纠纷的关键策略。
DeepMind 发布 AlphaGenome:突破百万碱基长序列预测,重塑基因组功能理解
DeepMind 正式推出 AlphaGenome,一款旨在全面解析基因组功能的新一代 AI 模型。该模型支持长达 100 万碱基对的输入,实现了单碱基分辨率的预测,突破了传统模型在序列长度与预测精度之间的权衡。AlphaGenome 不仅继承了 Enformer 的架构优势,还显著提升了计算效率,为基因调控机制、疾病变异评分及剪接位点建模提供了前所未有的高精度工具,现已通过 API 向非商业科研开放。
Qodo 自托管 DeepSeek-R1:开源推理模型赋能 IDE 开发工作流
Qodo 正式在 IDE 插件中支持自托管 DeepSeek-R1,填补开源领域与闭源推理模型(如 OpenAI o1)之间的能力鸿沟。该模型具备系统 2 级推理能力,在复杂代码审查与架构设计任务中表现卓越,同时提供高达 30 倍的成本优势和 5 倍的速度提升。开发者可通过 VSCode 和 JetBrains 插件无缝集成,享受安全、私有的 AI 编码辅助体验。
Kimi K3 发布:全球首个开源 2.8T 参数模型,重塑长程推理与自主智能体边界
Kimi 正式推出 Kimi K3,作为全球首个开源 2.8T 参数模型,基于 Kimi Delta Attention 与 Attention Residuals 架构,配备原生视觉能力与 100 万 token 上下文窗口。该模型在长程代码生成、GPU 编译器构建、芯片设计及科学计算等前沿任务中展现出自主智能体能力,部分任务效率超越传统专家系统。
ChatExcel 发布 Ultra 桌面版与科研智能体 OpenAI4S,重塑企业数据与 AI 科研双引擎
ChatExcel 近期重磅发布 Ultra 桌面版,支持本地文件处理、数据库直连及永久记忆,专为复杂企业数据场景打造。同时,联合北京大学实验室开源科研智能体 OpenAI4S,通过 Code-as-Action 重构 AI for Science 工作流。此外,ChatExcel AI Word 升级多模态能力,并打通飞书、企微、钉钉三大办公平台,构建全链路智能办公生态。
WatermarkRemover 上线:AI 驱动一键清除截图水印,重塑图像纯净度
WatermarkRemover 正式推出全新 AI 驱动的水印移除功能,专为处理截图与照片设计。通过先进的图像分析与内容重构算法,用户无需专业修图技能即可一键清除复杂水印。该工具主打免费、高效与高保真输出,显著降低了图像去水印的技术门槛,为内容创作者与开发者提供了便捷的图像净化方案。