模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Otter.ai 突破 10 亿会议转录里程碑并推出 OtterPilot 智能会议助手
Otter.ai 宣布成功转录超过 10 亿场会议,并正式推出 OtterPilot™。作为智能会议助手,OtterPilot 利用 AI 技术实现从自动加入会议、实时转录到幻灯片捕获及自动化总结的全流程自动化,旨在消除人工笔记负担,大幅提升团队协作效率。
Krea AI 发布 Node Agent:一句话驱动创意工作流,重塑 AI 创作范式
Krea AI 正式推出 Node Agent,将自然语言指令直接转化为可执行的创意工作流。该工具突破了传统 AI 工具‘从零开始’的局限,能够读取用户画布状态、复用历史节点并规划执行路径。通过智能验证、成本预估及增量迭代机制,Node Agent 旨在降低专业创作者使用复杂 AI 工作流的门槛,实现从‘描述想法’到‘生成成品’的无缝衔接。
Google 发布 Workspace Intelligence:重塑企业级 AI 代理工作流
Google 正式推出 Workspace Intelligence,旨在通过统一的实时理解能力,将分散的 Gmail、Docs、Sheets 等应用转化为协同工作的智能知识图谱。该更新引入了 Ask Gemini in Chat 作为统一命令行,支持跨应用任务自动化;Gemini 在 Sheets、Docs 和 Slides 中的能力大幅增强,支持自然语言生成表格、文档及幻灯片;同时,AI Inbox 和 AI Overviews 进一步优化了信息检索效率,标志着企业级 AI 代理从辅助工具向主动执行者的转变。
Genspark 发布全球首创 AI Docs:一句话生成专业文档,支持富文本与 Markdown 双格式
Genspark 于 2025 年 7 月 2 日推出全球首款 AI Docs 工具,实现通过单一提示词自动生成专业文档。该工具具备自动化排版、智能图文匹配、丰富模板库及无缝内容整合能力,并独创支持富文本与 Markdown 格式一键互转,彻底改变文档创作流程,赋能商务、教育等多场景高效协作。
Style3D 发布 Fabric Movement 模型:从静态图生成真实布料动态效果
Style3D 最新发布的 Fabric Movement 模型旨在解决 AI 视频生成中布料动态不真实的核心痛点。文章深入剖析了静态图像无法提供布料重量、垂坠感及恢复力等关键物理属性的局限,并提出了基于‘运动即证据’的生成策略。该更新特别针对电商场景,优化了短时长、低动态幅度下的服装视频生成,有效避免了长时视频中常见的物理逻辑崩坏与循环拼接问题。
APIMart 深度解析:dots-note-3.0 实现 IMO 满分突破,开启 AI 数学证明新范式
APIMart 深度编译了关于 dots-note-3.0 的最新技术突破。该模型由 RedNote/Xiaohongshu 推出,据称在 2026 年国际数学奥林匹克(IMO)中取得 42/42 的完美成绩。其核心不在于单一答案的正确率,而是通过“自然语言推理 + Python 代码验证”的迭代自我审查工作流,确保每一步逻辑的严密性。这一进展标志着 AI 从“猜答案”向“可辩护的完整证明”迈出了关键一步,为科研与教育领域带来深远影响。
Gemini 3 学术写作全指南:结构化提示词工程与论文框架设计深度解析
本文深度解析 Gemini 3 在学术领域的提示词工程应用,涵盖从论文框架设计到各章节撰写的完整流程。文章强调结构化提示词在逻辑构建、摘要提炼及文献综述批判性分析中的核心作用,旨在帮助研究者利用 AI 工具提升论文质量与效率,同时警示需保持专业判断。
scikit-learn 1.8 发布:交互式模型检查新功能重塑开发者体验
scikit-learn 正式推出版本 1.8,依托 Wellcome Trust 资助的 Chan Zuckerberg Initiative (CZI) 项目,大幅增强模型交互检查能力。新版本在 1.7 的基础上,为 HTML 可视化增加了参数文档链接、工具提示预览及完整参数名复制功能。这些改进显著降低了用户在 Jupyter Notebook 中调试和评估预测模型的门槛,标志着开源机器学习库在开发者体验 (UX) 领域的重大突破。
Cutout.Pro 发布 AI 老照片上色功能:深度学习和场景识别让黑白记忆重焕生机
Cutout.Pro 正式推出基于先进深度学习的 AI 老照片上色功能,利用数百万图像训练数据,精准识别人脸肤色与场景元素,实现黑白照片的自然色彩还原。该工具支持实时预览、批量处理及隐私保护,无需注册即可体验,为家庭历史影像修复提供了高效、专业的解决方案。
Sourcegraph 发布 Code Finder:专为 AI 代理设计的极速代码搜索引擎
Sourcegraph 正式推出 Code Finder,一款专为编程代理(Coding Agents)优化的专用搜索工具。通过引入‘分工协作’机制,Code Finder 独立执行搜索任务,将文件路径、行范围及上下文摘要直接交付给代理,大幅减少代理自身的搜索开销。实测数据显示,相比代理自行搜索,Code Finder 速度提升两倍,成本降低 40%,显著提升了大型代码库中的开发效率。
2026 年度 AI 视频模型终极对决:Veo 3、Sora 2 与 Kling 2.0 深度评测
2026 年 AI 视频生成领域迎来三大旗舰模型:Google Veo 3、OpenAI Sora 2 及 Kuaishou Kling 2.0 的激烈竞争。本文深度解析三者在原生音频生成、长视频连贯性、图像转视频保真度及成本效率上的核心差异。针对创作者,我们提供基于具体工作流(如品牌内容、叙事短片、社交媒体广告)的选型指南,并对比 Seedance 2.0 与 Runway Gen-4 的定位,助您以最低成本实现最高产出。
FLUX.1-Krea-Dev 发布:黑森林实验室联手 Krea AI 攻克 AI 生成“塑料感”难题
Black Forest Labs 与 Krea AI 联合发布 FLUX.1-Krea-Dev,该模型基于 120 亿参数架构,旨在彻底解决 AI 图像生成的“塑料皮肤”与色彩过饱和问题。作为开源权重模型,它提供极高的照片级真实感,支持云端 API、本地 ComfyUI 及 AWS Neuron 优化部署,为专业创作者和开发者提供了媲美专业摄影的生成体验。