模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
ClipDrop 发布 Image Relight:AI 实时重绘光影,重塑人像摄影质感
ClipDrop 正式推出 Image Relight 功能,利用先进 AI 技术实现照片的实时光影重绘。用户可添加新光源、调整颜色与强度,甚至通过 3D 空间重建实现物理级光照效果。该工具支持保留或移除背景,并承诺不降低输出图像质量,为摄影师和创作者提供了强大的视觉编辑手段。
Qodo Gen 1.5 发布:引入迭代工作流与终端执行能力,重塑智能编码 Agent 范式
Qodo 正式推出 Gen 1.5 版本,核心聚焦于 Agentic Mode 的智能化升级。新特性包括支持动态多步迭代工作流、IDE 内原生终端命令执行(Terminal MCP Tool)以及企业级安全管控(MCP 白名单与命令限制)。此次更新显著提升了 Agent 在复杂重构、跨框架迁移及自动化测试中的自主闭环能力,同时通过严格的治理机制满足了企业级安全合规需求。
Capsule 发布 Video First 内容策略:重塑 AI 视频生成与多模态交互新范式
AI 视频生成工具 Capsule 于 2026 年 9 月正式推出'Video First'战略,标志着其从纯文本生成向多模态优先的范式转移。此次更新引入了原生视频理解引擎与实时上下文感知 Agent,支持零样本视频转脚本及高精度动作控制。该策略旨在解决当前 AI 视频内容同质化难题,为创作者提供从创意构思到成片输出的全链路自动化解决方案,重新定义视频生产力的边界。
字节发布 Seedance 2.0:超越 Sora 与 Veo 的 AI 视频生成新纪元
字节跳动(TikTok 母公司)正式推出新一代 AI 视频模型 Seedance 2.0,据称性能超越 Sora 2 和 Veo 3.1。本文详解如何通过 Dreamina、Volcengine 及 Xiaoyunque 平台获取早期访问权限,并深度解析其六大核心能力,包括运动复刻、角色一致性、创意模板迁移及多镜头叙事等,为开发者与创作者提供实战 Prompt 技巧。
Google Nano Banana 上线 Dzine:基于 Gemini 2.5 Flash 的 AI 图像一致性生成新突破
Google 正式推出 Nano Banana,其内部代号即 Gemini 2.5 Flash Image,现已集成至 Dzine 平台。该工具专为解决 AI 绘画中角色一致性难题而生,支持通过自然语言对话进行图像编辑、场景融合及多轮迭代。相比 Qwen 和 Flux,Nano Banana 在保持人物特征与背景完整性方面表现卓越,适用于生成稳定的 AI 网红人设及高质量 UGC 内容。
燕雀光年 AI 发布全能设计引擎:重塑品牌视觉,零损耗升级超级符号
燕雀光年(Yanque AI)正式推出其全能设计引擎,旨在解决品牌视觉迭代中的核心痛点:如何在保持品牌识别度(Brand Recognition)不变的前提下,实现从经典到现代的极简主义转型。此次更新以麦当劳双 M 金拱门优化为案例,展示了 AI 在拆解超级符号、进行极简迭代及零丢失识别度重构方面的突破性能力,为中小品牌提供了低成本、高效率的视觉升级方案。
Anthropic 发布 Model Hardware Standard (MHS):AI 代理操作物理设备的统一标准
Anthropic 正式开放 Model Hardware Standard (MHS) 的研究预览版,旨在解决 AI 代理操作物理设备时的碎片化与安全隐患。MHS 通过标准化驱动、自然语言描述设备特性及统一控制协议(MCP),使 AI 能够像人类科学家一样自主编排实验、实时调整参数并处理硬件错误。该技术将设备集成时间从数周缩短至数小时,并支持跨设备并行操作,为生物制药、量子计算等领域带来革命性效率提升。
Higgsfield 发布 Seedance 2.0:4K 视频生成让现实 footage 变身电影级特效
Higgsfield 联合 Seedance 推出 Seedance 2.0,支持原生 4K 视频生成,完美解决以往生成中的人物形变与细节崩坏问题。通过引入 AI 技能(Skill)自动撰写提示词,用户只需输入自然语言指令(如“背景瞬间变为沙漠”),即可在保留原视频人物、动作、光影及镜头语言的基础上,实现环境无缝替换。该工具将视频编辑门槛降至最低,让创作者能轻松制作电影级 VFX 效果。
北大联合元空 AI 开源 OpenAI4S:Code-as-Action 重构科研智能体工作流
北京大学与元空 AI Agent 联合实验室今日开源科研智能体 OpenAI4S。该工具摒弃传统 ReAct 模式,首创 Code-as-Action 范式,允许模型直接向持久化 Jupyter 内核发送 Python/R 代码执行复杂科研任务。项目采用 MIT 协议,支持 BYOC 算力接入,旨在降低 AI for Science 门槛,推动科研过程的可复现与可追踪。
PaperXie 发布第五代智能改写引擎:语义重构与学科保护双驱动,适配 2026 双审新规
PaperXie 正式推出第五代智能改写降重功能,针对 2026 年高校“查重 +AIGC 双重审核”的新规进行深度优化。该引擎摒弃传统的同义词替换,采用语义层面重构技术,并内置分学科专属逻辑以保护专业内容准确性。同时,系统同步优化 AIGC 痕迹,提供多档改写强度与原文对照视图,助力用户在降低重复率的同时,确保论文逻辑连贯且通过 AI 检测。
Tabnine 推出 CLI 工具:将 AI 代码补全能力带入终端,重塑本地开发体验
Tabnine 正式推出 Tabnine CLI,标志着其 AI 代码智能从云端 IDE 插件向本地终端工具的重大跨越。该工具允许开发者直接在命令行界面(CLI)调用 Tabnine 的 LLM 能力,支持零样本代码补全、上下文理解及私有模型微调。此次发布填补了本地开发环境中缺乏强大 AI 助手的空白,为需要离线安全、低延迟或高度定制化代码生成场景的开发者提供了全新解决方案。
OpenAI 发布 ChatGPT Atlas:首个将浏览器转化为智能对话代理的 Web 探索新范式
OpenAI 于 2025 年 10 月 21 日推出 ChatGPT Atlas,一款基于 Chromium 构建的 macOS 专属浏览器。Atlas 彻底重构了 Web 交互逻辑,将传统搜索转化为自然语言对话,引入 AI 记忆系统与 Agent 模式,支持自动执行表单填写、数据比对等复杂任务。该工具强调隐私保护与跨平台数据迁移,标志着浏览器从被动信息展示向主动智能代理的范式转移。