Exa AI 发布 BM25 索引优化方案:内存降低 50% 且性能无损

ADK Exa AI官方 / ADK编译 2025-05-05 5 分钟 113 次浏览
速览导读 / Summary

Exa AI 宣布通过创新的编码方案与自适应查询算法,成功将 BM25 索引内存占用降低 50%,同时保持检索性能无损。该优化针对海量文档场景,通过频率分组存储与变长 Delta 编码技术,解决了传统倒排索引在扩展性上的瓶颈,为混合搜索架构提供了更高效的底层支撑。

内存优化幅度 50% BM25 索引内存占用降低
检索延迟 <500ms 检索数千个 Top 结果的最大延迟
索引规模 Billions 覆盖数十亿份文档的分布式索引

Key Insights / 核心看点

  • 1 通过频率分组与变长 Delta 编码,将 BM25 索引内存占用降低 50%,显著降低云基础设施成本。
  • 2 引入启发式候选选择与动态剪枝算法,在百亿级文档规模下保持亚秒级检索延迟。
  • 3 优化后的混合搜索架构在保留关键词精度的同时,大幅提升了海量数据的处理效率。
  • 4 解决了传统倒排索引在固定宽度整数与冗余频率存储上的存储浪费问题。

Exa AI 发布 BM25 索引优化方案:内存降低 50% 且性能无损

在组织互联网信息以应对复杂查询的使命中,Exa AI 深知传统关键词检索技术的重要性。尽管公司已在语义理解领域取得了显著进展,但其核心搜索架构依然采用混合模式,将关键词与嵌入(Embedding)方法完美结合。为了支撑这一架构在百亿级文档规模下的高效运行,Exa AI 近日宣布了一项重大突破:通过一种新颖的编码方案,成功将 BM25 索引的内存占用降低了 50%,且未牺牲任何检索性能。

优化背景:内存成为扩展瓶颈

随着索引规模的扩大,BM25 索引对内存的需求呈指数级增长。在分布式工作节点上,每处理 10 亿份文档,内存开销便超过 1.8TB,这对云基础设施成本构成了巨大压力。传统的倒排索引结构虽然保证了随机访问的速度,但在存储效率上存在显著浪费:

  • 碎片化分配:每个 postings list 都需要独立的内存分配,产生额外开销。
  • 冗余存储:文档 ID 使用固定的 32 位整数,即便实际数值较小也占用相同空间。
  • 结构填充:Rust 语言下的内存对齐机制导致数据排列效率低下。
  • 重复频率:Token 频率(通常在 1-15 之间)被重复存储于每份文档中。

面对这一挑战,Exa AI 团队确立了“每一比特都至关重要”的优化信条,从算法逻辑与数据结构两个维度进行了深度重构。

核心突破:双重优化策略

1. 智能候选选择与动态剪枝

在查询处理阶段,Exa AI 引入了启发式算法以提前筛选高价值文档:

  • 基于 IDF 的候选集构建:优先识别查询词中稀有度最高的术语(高 IDF 分数),利用其 postings list 构建初始候选集,实现“影响力排序索引”。
  • 阈值动态剪枝:在评分计算过程中,动态剔除那些数学上不可能进入前 N 结果的文档。这一机制灵感源自 WAND 算法,大幅减少了无效计算。

这种策略确保了系统仅在最有可能产生结果的文档上投入计算资源,将检索数千个 Top 结果的延迟控制在 500ms 以内。

2. 内存结构深度压缩

针对存储层面的浪费,团队实施了两项关键技术:

  • 基于频率的分组存储:不再为每个 (doc_id, freq) 对单独存储,而是将具有相同频率的文档聚合。由于 Token 频率分布范围极窄(1-15),仅需存储一次频率值即可覆盖多个文档,显著消除了冗余。
  • 变长 + Delta 编码:利用 postings list 中文档 ID 始终有序的特性,放弃固定 4 字节存储,转而存储相邻 ID 之间的差值(Delta)。结合变长编码技术,文档 ID 的存储空间被大幅压缩。

实际价值与应用场景

此次优化不仅降低了 AWS 等云服务的月度账单,更直接提升了用户体验。

  • 成本效益:在同等价格点下,系统可承载更多文档,或同等文档量下大幅降低硬件成本。
  • 性能保障:50% 的内存释放并未影响查询速度,反而因减少内存争抢提升了并发处理能力。
  • 生态赋能:为开发者提供了更高效的 Exa Search API 与 Agent 接口,使得构建基于混合搜索的智能应用变得更加经济可行。

Exa AI 表示,这一优化标志着其在处理超大规模数据检索方面迈出了关键一步,证明了通过精细化的数据结构设计,可以在不妥协性能的前提下实现巨大的资源节约。

"我们的目标是在不降低性能的前提下,从硬件中榨取每一滴性能。" —— Exa AI Technical Staff

Our 50% optimization on our BM25 index means we can now serve many more documents at the same price point — which means a better search experience.

Exa AI Technical Staff

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 与 Upscale.media 联手:AI 驱动图像超分辨率技术深度解析

Adobe Photoshop 与 AI 图像增强工具 Upscale.media 宣布深度整合,旨在为专业用户提供更高效的图像超分辨率解决方案。此次合作利用先进的 AI 算法,在不依赖复杂软件学习曲线的情况下,实现从低分辨率到高清图像的无损转换。文章详细阐述了该技术在保留细节、修复模糊以及支持多格式处理方面的核心优势,并展示了从上传到下载的完整操作流程,标志着图像增强领域向更智能化、便捷化方向迈出了重要一步。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布智能图像增强方案:AI 驱动高清修复与细节重构

Upscale.media 推出全新图像增强指南,详解如何利用 AI 技术将低分辨率图片转化为高清视觉内容。文章解析了图像上采(Upscaling)的核心原理,涵盖分辨率、锐度、色彩准确性等关键质量指标,并展示了该工具在商业展示、印刷输出及个人创作中的实际应用价值,旨在帮助用户摆脱像素化困扰,实现无损画质提升。

Upscale.media官方 / ADK编译 4 分钟
search · 免费
★ 5.0 · 120评测
E

Exa AI

专门为AI模型设计的搜索引擎平台

Exa AI是专门为AI模型设计的搜索引擎平台。为 AI 构建的一个搜索引擎,而非为人类构建一个新的搜索引擎,也就是 Google for AI。采用先进的向量数据库和嵌入模型技术,实现深度语搜索,超越关键词匹配,直接预测并提供相关链接。Exa AI的搜索引擎通过端到端Transformer架构优化,过滤SEO干扰,为AI代理提供准确、实时的互联网信息访问,支持大规模数据检索,助力AI的决策支持和深度学习。该公司已完成2200万美元融资,投资者包括英伟达等,致力于整合世界知识,服务于AI的未来。

查看 Exa AI 使用教程与功能