模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Lyrics Into Song AI 发布进阶指南:从提示词工程到多声部编曲的终极突破
Lyrics Into Song AI 推出《AI 音乐创作终极指南》,深度解析如何通过参数优化、结构化提示词(Prompt Engineering)及隐藏功能实现专业级音乐生成。文章涵盖情感曲线控制、多声部编曲(Duet)、节奏微调(BPM)及旋律参考等核心技术,旨在帮助开发者与创作者突破基础生成限制,构建完整且连贯的音频作品。
Claude 引入文本水印技术:合规驱动下的生成式内容溯源新标准
Anthropic 宣布 Claude 系列模型将集成基于 SynthID-Text 的文本水印技术,以符合欧盟《人工智能法案》要求。该技术通过改变模型选择词汇时的随机源,在不影响内容质量、可读性及增加 Token 消耗的前提下,实现对 AI 生成内容的概率性溯源。官方强调,水印对人类读者完全不可见,且无法关联具体用户或会话,旨在构建全球统一的 AI 内容标识体系。
AssemblyAI 发布 Universal-Streaming:毫秒级流式转录,重塑语音 Agent 交互体验
AssemblyAI 正式推出专为语音 Agent 设计的 Universal-Streaming 模型。该模型以约 300ms 的超低延迟提供不可变(Immutable)流式转录,解决了传统 STT 方案中“先出后改”的痛点。相比 Deepgram Nova-3,其词发射延迟降低 41%,P99 延迟缩短近一倍,并在实体识别准确率上提升 12%。凭借仅$0.15/小时的透明定价与无限并发能力,Universal-Streaming 成为构建高响应、高可靠语音交互系统的理想选择。
Sudowrite 发布科幻写作专用 AI 引擎:构建永不崩塌的硬科幻世界
Sudowrite 针对硬科幻写作痛点,推出深度定制的 Muse 模型与 Story Bible 系统。该工具专为解决长篇科幻作品中的技术一致性难题而设计,能够自动维护 FTL 物理规则、外星生物学设定及未来科技逻辑,确保百万字篇幅内的世界观严谨自洽。数据显示,使用 Sudowrite 的科幻作者首稿速度提升 400%,有效解决了通用大模型在叙事连贯性与技术细节记忆上的短板。
Notta 正式发布 Notta Brain:打造‘语音优先’AI 智能体,实现会议到 PPT 的全自动闭环
Notta 于 2026 年 1 月 30 日正式发布其核心 AI 智能体‘Notta Brain'。该智能体定位为‘语音优先’(Voice-First)的自动化执行引擎,能够深度融合企业内部文档与外部信息,从原始会议录音出发,自动完成从深度数据分析、文本生成到 PowerPoint 演示文稿制作的全流程。此次正式版大幅提升了多格式文件处理能力与自定义配置自由度,标志着 Notta 从单纯的会议记录工具向企业级智能决策辅助平台的关键跨越。
Sourcegraph MCP 服务器助 Claude Sonnet 4.6 击败 Mythos 级模型 Fable 5
Sourcegraph 发布最新基准测试,显示搭载其 MCP 服务器的 Claude Sonnet 4.6 在跨仓库代码发现任务中,以一半的成本击败了 Anthropic 最新的 Mythos 级模型 Fable 5。在 CodeScaleBench 的九项任务中,Sonnet 4.6 赢得六项,证明了在大型代码库中结合检索增强生成(RAG)与工具调用的性价比优势。
Recraft V4.1 发布:以自然美学重塑图像生成,短指令也能产出专业级视觉
Recraft 正式推出 V4.1 模型,主打“由自然而生”的视觉美学。相比 Midjourney 等竞品,V4.1 在 photorealism(照片级真实感)上表现更克制自然,能精准理解简短指令(如仅 3-5 词),在背景细节、人物神态及 3D 渲染质感上实现突破,特别适合需要真实生活感与专业设计感的商业应用场景。
MiniMax H3 视频编辑指南发布:DomoAI 平台赋能高效视频创作
MiniMax 与 DomoAI 联合发布 H3 视频编辑指南,旨在通过先进的 AI 模型优化视频生成与编辑流程。该指南重点介绍了文本到视频、图像动画及角色动画等核心功能,展示了 H3 模型在理解复杂指令与保持视觉一致性方面的突破。对于内容创作者而言,这一更新显著降低了视频制作门槛,提升了从创意构思到成品输出的效率,是 AI 视频工具领域的重要里程碑。
LensGo Iris 发布技能系统:专家模式赋能 UGC 广告与社交媒体内容创作
LensGo 正式推出 Iris 技能(Skills)系统,通过 UGC 产品广告、短视频、社交媒体海报等 10 种专家模式,将通用 AI 创作转化为垂直领域专业输出。该功能通过自动匹配平台原生格式、优化提示词工程及引导模型选择,显著降低创作者在格式与风格上的试错成本,实现从“通用生成”到“精准交付”的跨越。
LogoAI 发布圣诞主题 AI 摄影灵感:一键将自拍转化为节日肖像
LogoAI 最新推出 20+ 个趣味圣诞主题 AI 摄影灵感,利用其强大的图像生成能力,用户仅需输入基础文本或上传普通自拍,即可快速生成精美的节日头像、家庭合影及创意圣诞照片。此次更新展示了 LogoAI 在零样本(Zero-shot)生成与提示词工程方面的最新突破,为节日创作提供了全新的解决方案。
CrePal 上线 Boreal-Qwen-Image:基于 Qwen 架构的写实风格图像生成新突破
CrePal 平台正式引入 Boreal-Qwen-Image,这是基于 Qwen-Image 20B 参数架构开发的 LoRA 微调模型。该模型专注于生成具有真实光照、细腻纹理和自然场景的“无聊现实”风格图像,特别擅长处理人物与自然环境的交互。作为实验性模型,它利用特定的数据集解决了 AI 生成图中常见的戏剧化过度、浅景深和重复摆拍问题,为追求高保真摄影效果的开发者提供了新的工具选择。
玻尔 DPA4 发布:单卡 RTX 5090 实现 SOTA 精度,重新定义原子势能模型效率边界
由玻尔(Bohrium)联合北京大学等机构推出的 DPA4 模型,通过创新的 EMFA SO(2) 卷积架构,在 Matbench Discovery 榜单上斩获全球第一。相比前代模型 eSEN,DPA4 将训练成本从 300+ 张 GPU 天降低至单张消费级 RTX 5090 约 1 天,同时保持同等精度。该模型首次原生支持 torch.compile 编译加速,并在物理一致性上严格满足能量守恒与对称性要求,标志着高精度原子势能模型从云端超算走向桌面端。