模型发布 - AI 资讯
20万页 智能选型深度横向博弈,紧密跟踪前沿大模型发布与 AI 落地实战应用解析。
Krea Realtime 14B 发布:首款支持实时长视频生成的自回归模型
Krea AI 正式推出 Krea Realtime 14B,一款基于 Wan 2.1 蒸馏并采用 Self-Forcing 技术的 140 亿参数自回归视频生成模型。该模型突破了现有实时视频生成模型的参数瓶颈,实现了 11fps 的推理速度,支持用户在视频生成过程中实时修改提示词(Prompt)和重绘画面,彻底解决了传统扩散模型无法流式输出的痛点,为交互式创意工具奠定了坚实基础。
LTX Studio 发布 IC-LoRA:解锁视频生成与物理模拟的精准控制新范式
LTX Studio 正式推出 IC-LoRA(Image Control LoRA)技术,旨在解决现有视频生成模型在保持物体一致性、遵循物理规律及执行复杂动作时的精度不足问题。通过引入图像控制机制,IC-LoRA 允许开发者在训练阶段将特定物体的视觉特征与物理属性解耦,实现从静态图像到动态视频的高保真迁移。这一突破标志着 LTX 生态从通用内容生成向高精度、可预测的物理世界模拟迈出了关键一步,为电影级特效制作与虚拟仿真应用提供了底层技术支撑。
Kimi K2 开源:320 亿参数开启开放代理智能新纪元,支持 256K 上下文与自动工具编排
Kimi 官方正式发布 Kimi K2,一款专为代理任务优化的混合专家(MoE)模型。该模型拥有 320 亿激活参数和 1000 亿总参数,在前沿知识、数学及代码领域达到 SOTA 水平。Kimi K2 开源了 Base 与 Instruct 两个版本,并引入 MuonClip 优化器解决训练不稳定性。其核心突破在于无需复杂工作流即可自动理解并调用工具,支持 256K 上下文窗口,能够独立执行代码编辑、多步搜索及跨平台任务规划。
RunningHub RHSTORY 发布:一站式 AI 短剧全流程生成工具,从剧本到成片
RunningHub 推出 RHSTORY,专为解决 AI 短剧制作中角色一致性差、剧情割裂等痛点而设计。该工具提供从剧本创作、美术设定、分镜设计到短片生成的完整工作流,支持多角色资产复用与镜头级精细调整。官方发布详细教程及 Prompt 公式,助力创作者高效产出高质量连续剧情视频。
DeepSeek V4 发布:开源模型首次实现推理、代码与长上下文能力的全面逼近 GPT
DeepSeek V4 作为开源模型里程碑,首次在推理稳定性、代码生成、长上下文处理及计算效率四个维度全面逼近主流 GPT 系列。其采用 MoE 架构(1T 总参 +32B 激活参)与 1M token 工程化长窗口,显著降低推理成本并提升复杂任务可用性。本文深度解析其架构优势、与 GPT 的差异化定位及实际部署价值。
FLUX.1-Krea-Dev-GGUF 发布:8GB 显存即可运行,解决 AI 生成“塑料感”难题
Black Forest Labs 与 Krea AI 联合推出 FLUX.1-Krea-Dev-GGUF 模型,通过 GGUF 量化技术将显存需求降低 60%,仅需 8GB VRAM 即可在消费级显卡上运行。该模型针对早期 AI 绘画“皮肤塑料感”痛点进行优化,显著提升人像真实度与文字渲染能力,大幅降低专业级 AI 创作门槛。
Fast3D 发布:AI 驱动 3D 建模效率提升 500 倍,10 秒生成原型
Fast3D 正式上线,旨在彻底改变传统 3D 建模流程。该工具利用先进 AI 技术,将原本需要 17 小时的概念草图、建模、雕刻及渲染工作压缩至 10 秒内完成。文章详细阐述了其解决高门槛、高修改成本及创意发散困难三大痛点的能力,并展示了在产品设计、方案对比及客户沟通中的实际应用价值。
MiniMax H3 视频生成模型发布:多模态输入与本地部署能力解析
MiniMax 正式推出 H3 视频生成模型,支持多模态输入(文本、音频、图像)及异步 API 调用。文章详细阐述了 H3 的核心能力、本地部署可行性、API 成本估算公式、Prompt 编写规范及生产级集成流程,旨在帮助开发者快速构建高质量视频生成应用。
Qodo 发布 SWE-bench Verified 71.2% 高分:Claude 4 驱动下的生产级代码智能体突破
Qodo 宣布其 CLI 智能体 Qodo Command 在业界权威基准 SWE-bench Verified 中取得 71.2% 的卓越成绩,无需微调即可直接运行。该成果得益于与 Anthropic 的深度合作(采用 Claude 4 模型)、基于 LangGraph 的架构优化以及针对复杂代码库的上下文摘要与执行规划机制。此次突破标志着 AI 代码智能体从“辅助补全”向“独立解决真实工程问题”的重大跨越。
Suno 完成 54 亿美元融资,携手音乐行业推出首款合作音乐模型
Suno 宣布完成 54 亿美元融资,估值达 54 亿美元,由 Bond Capital 领投。此次融资旨在加速其核心使命:让更多人通过音乐表达自我。Suno 将推出首款与音乐行业深度合作开发的音乐模型,旨在为粉丝创造新体验,并帮助艺术家触达更广泛的受众,构建社区并解锁新的创作与经济可能性。
Vizard API 升级:全新 clip_v2 模型上线,以更高精度重塑视频剪辑工作流
Vizard 正式推出新一代 AI 剪辑模型 clip_v2,旨在通过更高质量的输出替代海量低质片段。开发者可通过 API 新增的 clipModel 参数灵活切换模型。clip_v2 虽计费成本提升 25%,但在视频完整性、结构连贯性及营销内容产出质量上实现显著突破,适合对内容品质有严苛要求的团队。
Vizard 发布 Model v2:以全上下文剪辑重塑短视频增长逻辑
Vizard 正式推出 Model v2,专为解决传统 AI 剪辑工具‘上下文缺失’痛点而设计。与侧重速度的 Model v1 不同,Model v2 通过算法深度理解内容逻辑,自动保留‘铺垫 - 洞察 - 收尾’的完整叙事结构。其核心突破在于提供多维度的病毒指数分析(Hook Strength, Takeaway, Story Flow)及精准标签,显著降低内容筛选成本,帮助创作者在 TikTok、Reels 等平台上实现从‘碎片化’到‘完整故事’的质变。