Glean 发布 Jev:零样本分类器的回归与系统一模型架构解析

ADK Glean官方 / ADK编译 2026-09-29 4 分钟 57 次浏览
速览导读 / Summary

Glean 工程团队正式推出 Jev,一款专注于‘系统一’决策的零样本分类模型。Jev 通过 API 提供无需微调即可进行结构化输出的能力,在查询分类等场景中相比通用 LLM 实现了数量级级的成本与延迟优化。实测数据显示,Jev 在保持灵活性的同时,显著优于开源零样本模型,并在特定任务上具备与微调模型竞争的能力,重新定义了企业级结构化决策的架构路径。

任务一致性 66.8% 在查询分类任务中超越开源基线模型
吞吐量 ~12 分钟 (并发 4) 相比本地微调模型实现吞吐量级提升
架构特性 零样本 (Zero-shot) 无需微调即可适应新任务

Key Insights / 核心看点

  • 1 推出 Jev 模型,专为结构化决策(System One)设计,支持零样本分类任务。
  • 2 相比通用 LLM,在查询分类等场景中实现数量级级的成本降低与延迟优化。
  • 3 无需微调即可动态调整分类任务,仅需更新 API 配置,大幅降低运维成本。
  • 4 实测显示在特定任务上超越开源零样本模型,具备与微调模型竞争的能力。

Glean 发布 Jev:零样本分类器的回归与系统一模型架构解析

在 AI 应用开发中,当系统需要做出明确的标签、评分或二元判断时,开发者往往面临一个经典的技术权衡:是调用通用大语言模型(LLM)进行灵活但昂贵的推理,还是部署专门的分类模型以换取效率和稳定性?

针对这一痛点,Glean 工程团队近日发布了 Jev,一款旨在解决‘系统一’(System One)决策场景的新型模型。Jev 的核心价值在于它提供了一种无需收集新训练数据、无需微调即可通过 API 获取结构化输出(包括选择、分数及概率)的解决方案。

为什么需要 Jev?

分类任务并非新鲜事,从传统的开源分类器到微调后的专用模型,生态中已存在多种方案。然而,通用 LLM 在处理此类任务时存在明显的‘性能 - 成本’劣势:

  • 通用 LLM:具备零样本(Zero-shot)灵活性和生成解释的能力,但需为微小的决策支付昂贵的自回归延迟和计算成本。
  • 微调分类器:在稳定高并发任务中表现最佳,但面临数据收集、训练周期长、类别体系僵化等维护成本。
  • 开源零样本模型:成本低且可控,但质量参差不齐,且需要开发者自行解决模型部署和推理优化的难题。

Jev 试图填补这一空白,它结合了零样本的灵活性与托管 API 的便捷性,让团队能够动态调整问题与选项,而无需重新训练模型。

实测数据:超越开源,挑战微调

Glean 团队在内部测试了四个受约束的决策场景,重点对比了 Jev 与开源模型 Laya(及其微调版本)以及基于 LLM 的基线系统。实验结果显示,Jev 在成本降低和延迟优化上取得了显著成果。

在查询分类(Query Classification)实验中,Jev 展现了强大的竞争力:

实验模型 任务一致性 (Broad Task Agreement) 性能 (Perf)
Jev (零样本) 66.8% ~12 分钟 (并发 4)
Base Laya (开源) 35.9% ~90 秒 (本地开发机)
Fine-tuned Laya (微调) 74.5% ~90 秒 (本地开发机)

注:性能单位为完成特定测试集所需的预估时间,数值越小代表吞吐量越高。

尽管微调后的 Laya 在准确率上略胜一筹,但 Jev 以极低的成本提供了接近的零样本性能,且其吞吐量优势巨大。对于大多数企业级应用而言,这种‘无需训练即可上线’的能力极具吸引力。

核心亮点与技术指标

  1. 系统一架构设计:Jev 专为结构化决策设计,输出包含选择、分数和概率,完全摒弃了不必要的文本生成过程。
  2. 零样本灵活性:无需微调即可适应新的分类任务,仅需更新 API 中的问题与选项定义。
  3. 性能与成本双重优化:相比通用 LLM,在特定决策任务上实现了数量级级的成本降低和延迟提升。

关键指标 (Metrics):

  • 版本/指标: Jev v1.0
  • 描述: 引入零样本分类 API,支持结构化输出
  • 版本/指标: 66.8% 任务一致性
  • 描述: 在查询分类任务中超越开源基线模型
  • 版本/指标: ~12 分钟 (并发 4)
  • 描述: 相比本地微调模型实现吞吐量级提升

结语

Jev 的发布标志着 AI 工具在‘分类’这一基础能力上的回归与进化。正如 Glean 团队所言,"我们无需为微小的决策支付昂贵的自回归成本"。对于追求高效、稳定且灵活的企业级 AI 应用开发者而言,Jev 无疑是一个值得关注的架构级工具。

“We could build it ourselves is true of most infrastructure products. Jev offers zero-shot flexibility behind a clean, hosted API.”

— Glean Engineering Team

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟