KI
AI 对话助手 发布方:Kimi ⭐ 5 累计 9 条资讯动态

Kimi智能助手 官方最新动态与版本发布资讯

月之暗面推出的AI智能助手

官方发布与版本更新历史记录

第 1 / 1 页 (共 9 条)
2026-09-05 产品动态 | 版本升级 | 技术解读 | 生态合作
官方原文

Kimi 开源 Vendor Verifier:重构模型信任链,解决开源部署质量失控难题

Kimi 在发布 K2.6 模型的同时,开源了 Kimi Vendor Verifier (KVV) 项目。针对开源模型在第三方部署中因解码参数滥用及基础设施差异导致的评分异常问题,Kimi 构建了包含 OCRBench、AIME2025 等六大核心基准的自动化验证体系。通过强制 API 参数约束、上游社区修复及持续公开排行榜,Kimi 致力于解决“模型能力缺陷”与“工程实现偏差”的混淆,重建开源生态的信任链。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-07-22 产品动态 | 模型评估 | 视觉 AI
官方原文

Kimi 发布 PerceptionBench:基于真实失败案例构建的原子化视觉感知基准测试

Kimi 团队正式推出 PerceptionBench,这是一个旨在评估多模态大语言模型(MLLMs)原子化视觉感知能力的基准测试。该基准摒弃了预设定义,直接从 42 个前沿模型的失败案例中归纳出 10 种原子能力,构建了 3000 道经过验证的原子级问题。结果显示,目前没有任何模型在原子视觉感知任务上达到 60% 的准确率,揭示了当前 MLLMs 在视觉忠实度上的重大短板。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-07-17 模型发布 | 技术突破 | 开源生态
官方原文

Kimi K3 发布:全球首个开源 2.8T 参数模型,重塑长程推理与自主智能体边界

Kimi 正式推出 Kimi K3,作为全球首个开源 2.8T 参数模型,基于 Kimi Delta Attention 与 Attention Residuals 架构,配备原生视觉能力与 100 万 token 上下文窗口。该模型在长程代码生成、GPU 编译器构建、芯片设计及科学计算等前沿任务中展现出自主智能体能力,部分任务效率超越传统专家系统。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-07-13 模型发布 | 版本升级 | 技术解读 | 生态合作
官方原文

Kimi K2 开源:320 亿参数开启开放代理智能新纪元,支持 256K 上下文与自动工具编排

Kimi 官方正式发布 Kimi K2,一款专为代理任务优化的混合专家(MoE)模型。该模型拥有 320 亿激活参数和 1000 亿总参数,在前沿知识、数学及代码领域达到 SOTA 水平。Kimi K2 开源了 Base 与 Instruct 两个版本,并引入 MuonClip 优化器解决训练不稳定性。其核心突破在于无需复杂工作流即可自动理解并调用工具,支持 256K 上下文窗口,能够独立执行代码编辑、多步搜索及跨平台任务规划。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-07-13 模型发布 | 技术解读 | 智能体 | 版本升级
官方原文

Kimi 发布 K2 Thinking:测试时缩放与智能体推理的里程碑突破

Kimi 正式推出 K2 Thinking,一款专为智能体设计的开源推理模型。该模型通过测试时缩放(Test-time Scaling)技术,在保持 INT4 量化高效推理的同时,实现了长达 200-300 步的工具调用与复杂任务规划。在 HLE、SWE-Bench 等权威基准测试中创下多项 SOTA 记录,显著提升了代码生成、深度搜索及长文本创作能力,标志着 AI 智能体从‘单步响应’向‘自主长期规划’的跨越。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-04-20 模型发布 | 版本升级 | 技术解读 | 生态合作
官方原文

Kimi K2.6 开源:长程代码执行与智能体集群能力实现新突破

Kimi 正式开源 K2.6 模型,重点突破长程代码执行与智能体集群(Agent Swarm)能力。该模型在 Kimi Code Bench 上表现卓越,支持 Rust、Go 等语言及前端、DevOps 等复杂任务。实测中,K2.6 在长达 12 小时、4000+ 次工具调用的任务下,吞吐量从 15 提升至 193 tokens/sec,并成功重构 8 年旧代码库,性能提升 185%。其精准的代码修复与架构理解能力,标志着开源模型在复杂工程任务中达到闭源模型水平。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-02-13 模型发布 | 技术解读 | 评测基准
官方原文

Kimi 发布 WorldVQA:首个聚焦原子级视觉世界知识的 MLLM 评测基准

Kimi 团队正式发布 WorldVQA,这是一个旨在衡量多模态大语言模型(MLLMs)原子级视觉世界知识事实正确性的全新基准。该数据集包含 3500 个高质量图文对,覆盖自然、地理、文化等 9 大类,并严格区分长尾知识。评测显示,即便是顶尖模型在长尾知识上的准确率也常低于 50%,且普遍存在过度自信(Overconfidence)问题。Kimi-K2.5 在该基准上表现最佳,ECE 为 37.9%,Slope 为 0.550,但仍需大幅提升自我认知能力。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-02-13 产品动态 | 版本升级 | 模型发布 | 技术解读
官方原文

Kimi 发布 Agent Swarm:重构 AI 工作流,100 个智能体协同并行

Kimi 正式推出 Agent Swarm,标志着 AI 从单一模型推理向自主组织化架构的范式转移。该功能允许 Kimi K2.5 自主部署多达 100 个并行子智能体,通过动态分工与协作,解决长程任务中的上下文丢失问题。相比传统串行执行,Agent Swarm 在并行处理速度上提升 4.5 倍,支持超 1500 次工具调用,适用于大规模数据聚合、专业报告生成及多视角决策分析等复杂场景。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文
2026-01-31 模型发布 | 技术解读 | 生态合作
官方原文

Kimi K2.5 发布:视觉智能体群与代码视觉化双重突破

Kimi 正式发布开源最强模型 Kimi K2.5,主打视觉智能体(Visual Agentic Intelligence)与代码视觉化能力。K2.5 支持自主调度高达 100 个子智能体的并行工作流,执行效率提升 4.5 倍;同时具备从视频/图像生成前端代码及视觉调试的卓越能力,标志着 AI 从单模态向多模态协同执行的重大跨越。

编辑:Kimi智能助手官方 / ADK编译 阅读资讯全文