模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Notta 发布 Notta Brain:从对话摘要到智能业务洞察的进化
Notta 正式推出全新核心功能 Notta Brain,标志着其从基础会议录音转写向深度业务智能分析的战略升级。Notta Brain 不仅支持实时会议摘要,更具备跨源数据整合、多模态文档解析及定制化专家输出能力。此次更新将彻底改变企业利用 AI 进行决策支持的流程,预计于 2026 年 4 月 1 日面向付费用户上线。
Pika 发布 Agent 经济新模式:AI 自我首次可获真实收益
Pika 于 2026 年 4 月宣布重大变革,首次允许用户构建的 AI Self Agent 通过对话与技能使用赚取真实收益。该更新颠覆了传统 AI 平台“用户付费、平台获利”的单向经济模型,转向“用户投资、AI 回报”的共赢机制。用户可通过训练个性化 Agent、赋予独特技能来增加其市场价值,从而获得可兑换现金的代币奖励。
Logo Diffusion V.3 发布:全新从头训练模型支持文本 Logo 生成与 45 种艺术风格
Logo Diffusion 正式发布 V.3 版本,核心升级包括从零开始重新训练的 Logo 设计 AI 模型,显著提升了提示词理解准确率,特别是实现了文本 Logo(Logotype)的稳定生成。新版本扩展至 45 种艺术风格,新增 Sketch 转图、背景移除、矢量化等专用工作区,并优化了色彩选择与负向提示词交互体验,为品牌设计师提供更高效、精准的 AI 辅助工具。
DomoAI 发布 2000 年代风格音乐视频生成器:复刻千禧年赛博美学
DomoAI 于 2026 年 8 月推出全新创意功能,旨在帮助用户利用 AI 快速生成具有鲜明 2000 年代风格的音乐视频。该工具融合了复古像素艺术、低分辨率质感及千禧年流行文化元素,支持从文本或图像直接生成视频。开发者可借此功能低成本复刻经典视觉风格,内容创作者能迅速产出符合特定怀旧审美的短视频内容,满足社交媒体对复古潮流的持续需求。
Krea AI 发布 Krea Edit:实现区域编辑、上色与重绘,重塑图像创作流程
Krea AI 正式推出 Krea Edit,一款专注于图像精细化编辑的新一代工具。它摒弃了传统的全图重绘模式,支持用户通过框选区域进行局部修改、移动物体、扩展画幅。此外,工具还集成了虚拟灯光系统(Relight)、相机镜头模拟器及灰度上色功能,允许用户对图像进行多步骤迭代创作,极大提升了从生成到成品的效率。
Bohrium 发布 CS 科研新范式:从代码生成到论文溯源的全链路 AI 工具链
Bohrium 发布深度编译指南,重新定义计算机科学领域的 AI 工具使用范式。文章强调拒绝“万能回答机”,主张基于工作流(Workflow)的工具组合策略。重点介绍了 Bohrium 在科研领域的独特优势,支持多约束条件论文检索、自动引用溯源及结构化对比分析。同时对比分析了 Cursor、GitHub Copilot 等主流代码工具在 IDE 集成与权限控制上的差异,为开发者提供了一套兼顾教育、研究与工程落地的完整技术栈建议。
Gemini 4 研发确认:Google 启动最雄心勃勃预训练,Atoms 开发者如何提前布局?
Google 正式确认 Gemini 4 已进入最雄心勃勃的预训练阶段,但截至 2026 年 9 月 5 日,该模型尚未公开发布,无 API 接口或定价信息。本文深度解析官方确认事实与网络预测图表的区别,并基于 Atoms 平台特性,为开发者梳理了软件工程、科学计算及多模态等七大优先测试领域,助企业在模型落地前构建验证工作流。
Seedream 5.0 Pro 发布:AI 图像生成迈向智能创作新阶段
Seedream 5.0 Pro 正式发布,针对图像质量、文字渲染、页面布局及图片编辑四大核心维度进行深度升级。新模型显著提升了复杂场景下的细节还原能力与多模态理解水平,为设计师、运营人员及企业团队提供了更高效的海报、产品图及营销素材创作方案。
爱图表发布:AI 驱动的智能图表创作新平台,重塑数据可视化效率
爱图表正式推出,作为镝数图表的独立 AI 进化版,主打“零代码”与“自然语言交互”。平台通过大模型技术实现数据自动选型、描述生成图表、智能趋势分析及图像无损放大等功能,旨在降低专业设计门槛,让非技术人员也能高效产出高质量可视化内容。
IBM Watson 发布新一代智能语音引擎:将生成式 AI 转化为可落地的企业级语音交互
IBM Watson 于 2026 年 Think 大会上重磅发布新一代智能语音交互引擎,标志着其从传统 TTS 向自主智能体(Agentic AI)的转型。此次更新引入了基于上下文感知的动态语音合成技术,支持多模态 Agent 自主决策,并大幅降低了企业部署门槛。该引擎不仅提升了语音生成的自然度与情感表达,更实现了从‘被动响应’到‘主动服务’的跨越,为客服、教育及无障碍领域带来革命性体验。
Cutout.Pro 深度解析:AI 图像抠图如何攻克植物与宠物边缘难题
Cutout.Pro 发布技术文章,深入解析其核心算法“图像蒙版(Image Matting)”原理。文章指出,传统二值化抠图无法处理毛发、叶片等半透明边缘,而 Cutout 基于 Jiake Xie 的学术研究成果,通过计算每个像素的 Alpha 透明度值(0-1),实现了植物叶片镂空与宠物毛发晕染的高保真处理。文章强调了输入图像分辨率、边缘对比度及对焦清晰度对最终效果的决定性作用,并通过莫斯树(Monstera)和宠物毛发案例验证了其在复杂场景下的表现。
Google 发布 Nano Banana 2:Gemini 3.1 Flash 图像模型实现秒级生成与精准文字渲染
Google 正式推出 Nano Banana 2(Gemini 3.1 Flash Image),作为 Nano Banana Pro 的继任者,该模型在保持秒级生成速度的同时,显著提升了图像一致性、文字渲染精度及多比例支持。文章详细介绍了该模型的核心特性、通过 Dzine AI 和 Gemini 平台的免费使用指南,以及针对社交媒体、电商设计等场景的实战 Prompt 技巧。