Lucy 构建 280 万份财报检索层:Qdrant TurboQuant 量化与混合搜索实战

ADK Qdrant官方 / ADK编译 2026-09-21 5 分钟 69 次浏览
速览导读 / Summary

金融 AI 公司 Lucy 利用 Qdrant 构建针对 280 万份 SEC 及 DART 财报的“事实来源”检索层。通过 TurboQuant 4 位量化技术,内存占用降低 4.9 倍(52GB 降至 10.7GB)且保持检索质量。结合 Payload 过滤与混合搜索(Dense+BM25),Lucy 在 FinanceBench 评测中 Recall@20 超 94%,显著优于通用大模型,解决了金融领域对数据可追溯性与精度的严苛要求。

内存压缩比 4.9x 4-bit TurboQuant 将 10.7GB 内存占用降至 52GB
Recall@20 >94% FinanceBench 评测中的检索召回率
语料规模 2.8M+ 覆盖 27 种申报类型的 SEC 及 DART 文件

Key Insights / 核心看点

  • 1 TurboQuant 4 位量化技术将 10-K 语料库内存占用降低 4.9 倍(52GB -> 10.7GB),同时保持检索质量
  • 2 采用 Payload 过滤与混合搜索(Dense+BM25+RRF)策略,在 280 万份财报中实现 Recall@20 超 94%
  • 3 解决金融领域痛点:相比通用大模型,基于原始 SEC 文件的检索层能提供可追溯且更准确的回答
  • 4 支持 27 种申报类型及 10 年历史数据,实现近实时处理与水平扩展架构

Lucy 构建 280 万份财报检索层:Qdrant TurboQuant 量化与混合搜索实战

在金融 AI 领域,准确性意味着金钱。Lucy 是一家专注于构建金融数据基础设施的公司,其核心挑战是将美国 SEC EDGAR 系统与韩国 DART 系统中长达 10 年(2016-2026)的 280 万+份监管文件,转化为 AI 系统可检索、可推理的结构化数据。

这些文件涵盖 10-K、10-Q、8-K 等 27 种申报类型,单份文件长达 200 页,包含复杂的表格、图像及交叉引用。Lucy 的愿景是:利用精心构建的检索层,让轻量级开源模型在回答特定财务问题时,表现优于依赖网络搜索的顶级大模型(Frontier Models)。

为什么通用大模型在金融领域“失灵”?

分析师和投资者普遍发现,直接询问 ChatGPT 或 Claude 关于公司财报的具体问题时,模型常返回错误答案。在金融领域,一个数字的错误可能导致数百万美元的损失,因此标准不是“大致正确”,而是“可追溯至原始申报文件”。

构建这一检索层面临两大难题:

  1. 数据质量:如何将 200 页的文档转化为保留原始表格结构、标准化 XBRL 事实且带有来源链接的文本块?
  2. 检索精度:在数百万文档中,如何确保正确的片段排在首位,而非仅仅依赖语义相似度?

Qdrant 的核心价值:混合搜索与极致量化

Lucy 选择 Qdrant 并非偶然,而是基于三个关键需求:

1. 原生 Payload 过滤

财务查询携带大量结构化信号(如 CIK 编号、表单类型、特定条款)。Qdrant 的 Payload Filtering 允许在查询执行时直接应用这些过滤条件,而非在向量检索后二次筛选,极大提升了检索效率。

2. 混合搜索(Hybrid Search)

财务文本包含大量专有名词和表格项,仅靠嵌入向量(Embeddings)容易遗漏。Lucy 采用 Dense Vectors(语义匹配)与 Sparse Vectors(BM25 精确匹配)结合的混合搜索策略,并通过 Reciprocal Rank Fusion (RRF) 融合排名,确保召回率。

3. TurboQuant 量化技术

随着语料库规模扩大,存储成本成为瓶颈。Lucy 评估了 Qdrant 的 TurboQuant 技术,发现其能在几乎不损失检索质量的前提下大幅降低内存占用。

关键性能指标与实测数据

Lucy 在 FinanceBench 等基准测试中取得了显著成果:

  • 内存压缩效率:在 1,536 维度的 10-K 语料库上,4 位 TurboQuant 将内存占用从约 52 GB 降至 10.7 GB,压缩比高达 4.9 倍。
  • 检索质量保持:在去除元数据过滤的测试中,混合检索(Dense + BM25)的 Recall@20、MRR 和 nDCG@20 指标相比纯稠密检索分别提升了 0.2%、0.1% 和 0.1%,证明稀疏侧有效弥补了量化带来的稠密侧损失。
  • 最终评测表现:Lucy 的检索层在 FinanceBench 上实现了 Recall@20 超过 94%,仅靠检索优化就带来了 0.16 的回答准确率提升。

Lucy 工程师 Jongbok Lee 指出,对于韩语 DART 文件,他们采用了更激进的 2 位量化以节省空间,而针对 SEC 文件则保守使用 4 位量化,这种策略平衡了成本与精度。

总结

Lucy 的案例证明了在垂直领域,一个精心设计的检索层(RAG)结合高效的向量数据库(Qdrant),能够超越通用大模型。通过 TurboQuant 解决存储瓶颈,通过混合搜索解决精度痛点,Lucy 为金融 AI 提供了可信赖的“事实来源”层。

“In finance, a wrong number in the wrong place can cost millions of dollars, so the standard for a usable answer is not “mostly right.” It is “traceable to the filing.””

— Jihoi Park, Co-Founder, Lucy

同主题深度资讯

查看更多 →
模型发布 2026-10-08

PyTorch 原生集成 Spyre 加速器:打造企业级推理新范式

PyTorch 官方宣布通过 `torch-spyre` 库将 IBM 的 Spyre 数据流 AI 加速器打造为 PyTorch 的原生设备。此次更新实现了从设备身份、内存分配器到编译图的全链路映射,支持 `tensor.to("spyre")` 等标准操作。核心突破在于利用 Spyre 的独立计算与数据移动流水线,在保持 PyTorch 易编程性的同时,实现了极低延迟的推理加速,为 IBM Z 及 Power 系统上的企业级 AI 应用提供了统一且高效的执行路径。

PyTorch官方 / ADK编译 5 分钟
模型发布 2026-10-08

Pixmax 发布全链路游戏素材生成平台,覆盖研发至买量全阶段

Pixmax 正式发布专为游戏行业打造的 AI 素材生成平台,深度理解游戏开发工作流,支持从研发立绘、场景贴图到宣发买量素材的全链路生产。平台通过“上传 - 生成 - 批量 - 适配”四步流程,解决风格统一与批量产出难题,显著降低美术成本与试错周期,助力中小团队提升生产效率。

Pixmax官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo 发布 Temu GIF 转视频广告工具:15 秒内重构电商素材

AdsTurbo 推出针对 Temu 平台优化的 GIF 转视频广告工具,旨在将静态循环动图重构为具备叙事性的 15 秒短视频。该工具不仅进行格式转换,更通过 AI 提取关键帧、生成解说词与字幕、匹配多平台导出规范,帮助商家将零散的产品证据转化为高转化率的垂直视频素材,显著提升广告素材的复用性与合规性。

AdsTurbo AI官方 / ADK编译 3 分钟
AI 工具 2026-10-08

AdsTurbo AI 发布无拍摄电商视频广告 SOP:单图生成 12 变体测试矩阵

AdsTurbo AI 推出针对独居电商卖家的‘无拍摄视频广告工作流’,旨在通过单一产品图和核心卖点,快速生成 12 种不同变体的短视频广告。该 SOP 强调结构化输入与模块化脚本,利用 3x2x2 组合矩阵实现高效 A/B 测试,帮助卖家在不依赖传统拍摄团队的情况下,快速验证不同钩子(Hook)、证明点(Proof)和行动号召(CTA)的转化率,大幅降低试错成本。

AdsTurbo AI官方 / ADK编译 3 分钟