Qdrant 1.19 发布:TurboQuant 四倍压缩与统一内存层级架构升级

ADK Qdrant官方 / ADK编译 2026-08-05 4 分钟 34 次浏览
速览导读 / Summary

Qdrant 1.19 重磅推出 TurboQuant Datatype,将向量存储压缩率提升至 9 倍(从 36bit 降至 4bit),显著降低磁盘占用并提升 I/O 吞吐。同时引入统一的 Memory Tiers 参数,简化了 pinned/cached/cold 三级内存管理逻辑。此外,新增租户级 IDF 统计以优化多租户 BM25 搜索精度,并支持关键词字段前缀匹配与切片过滤,极大增强了检索灵活性与多租户场景下的性能表现。

存储压缩率 9x Turbo4 Datatype 相比传统存储方案
内存配置 Unified 单一 memory 参数管理所有组件
新增过滤能力 2 前缀匹配与 Slice 切片

Key Insights / 核心看点

  • 1 Turbo4 Datatype 实现 9 倍存储压缩,将向量从 36bit 降至 4bit,大幅降低磁盘占用并提升 I/O 吞吐。
  • 2 引入统一的 Memory Tiers 参数,将 pinned/cached/cold 三级内存管理逻辑标准化,简化配置复杂度。
  • 3 支持租户级 IDF 统计计算,解决多租户场景下 BM25 搜索因词汇混合导致的评分失真问题。
  • 4 新增关键词字段前缀匹配与 Slice 切片过滤,增强检索灵活性与大规模数据并行处理能力。

Qdrant 1.19 发布:TurboQuant 四倍压缩与统一内存层级架构升级

Qdrant 官方于 2026 年 8 月 5 日发布了 1.19.0 版本,此次更新聚焦于存储效率革命内存管理简化两大核心方向。在向量数据库面临海量数据存储成本与检索延迟的双重压力下,Qdrant 通过引入 TurboQuant Datatype 和统一的 Memory Tiers 机制,为开发者提供了更极致的性价比与更清晰的架构配置。

核心突破:TurboQuant Datatype 实现 9 倍存储压缩

Qdrant 此前在 1.18 版本中推出的 TurboQuant 量化技术,仅作为 HNSW 遍历的辅助层,保留了全精度副本以确保召回率。而在 1.19 中,Qdrant 将这一理念延伸至存储层本身,正式推出了 Turbo4 Datatype

  • 存储压缩率提升 9 倍:Turbo4 仅使用 4-bit 的 TurboQuant 压缩表示存储向量,彻底摒弃了全精度(float32)副本。相比传统的 36-bit 每维(12-bit 全精度 + 4-bit 压缩),存储空间直接缩减至 4-bit,实现9 倍的存储压缩
  • I/O 性能飞跃:大幅减少的数据读写操作显著提升了吞吐量,尤其对于 ColBERT 风格的 Multi-vector 集合,收益更为显著。
  • 适用场景明确:该特性适用于对存储成本敏感、且能接受轻微召回损失的场景。若追求极致召回率,仍需保留全精度副本。

架构简化:统一 Memory Tiers 参数

过去,Qdrant 中向量、索引、稀疏索引等组件各自拥有独立的内存配置参数(如 on_disk, always_ram 等),导致配置碎片化。1.19 版本通过引入单一的 memory 参数,实现了全组件的统一内存层级管理。

该参数支持三种层级:

  1. pinned:组件数据完全加载至内存,永不驱逐(适用于高频访问的 HNSW 图链接)。
  2. cached:数据驻留磁盘,启动时预填充 OS 缓存,平衡速度与空间。
  3. cold:懒加载,仅在首次访问时从磁盘读取。

此外,稀疏索引和量化向量也获得了独立的层级控制能力,进一步增强了灵活性。

多租户优化:租户级 IDF 统计

在多租户部署中,传统的 IDF(逆文档频率)计算基于整个数据集,导致不同租户间的词汇差异被模糊,严重影响 BM25 搜索的准确性。Qdrant 1.19 允许将 IDF 统计范围收窄至特定租户,使术语稀有度更真实地反映该租户的语料分布,从而显著提升多租户环境下的混合搜索(Hybrid Search)效果。

检索增强:前缀匹配与切片过滤

  • 关键词字段前缀匹配:支持在 Keyword Index 上直接进行前缀过滤(如 prefix: "https://qdrant"),无需全量扫描或依赖文本索引,速度媲美其他索引过滤。
  • Slice 切片过滤:新增 slice 条件,将集合划分为确定性、互斥的子集。这使得并行处理、分片滚动查询等复杂模式成为可能,为大规模数据的高效遍历提供了新路径。

开发者价值总结

Qdrant 1.19 不仅解决了存储成本与性能之间的矛盾,更通过统一的配置模型降低了运维复杂度。对于构建大规模向量检索系统、多租户 SaaS 应用或需要极致性价比的 AI 基础设施团队而言,此次更新提供了关键的架构升级选项。

"我们致力于让向量数据库在存储效率与检索速度之间找到最佳平衡点,Turbo4 和 Memory Tiers 正是这一愿景的具象化体现。" —— Qdrant 官方团队

We've applied the same method to storage itself. The new Turbo4 datatype stores vectors using 4-bit TurboQuant compression as the only representation, with no full-precision copy kept.

Qdrant Official Blog

同主题深度资讯

查看更多 →
产品动态 2026-09-15

Topview 发布 Codex 插件工作流:在 ChatGPT 生态内实现 AI 视频生成

Topview 正式宣布其插件工作流集成至 OpenAI 的 Codex 代理系统,支持在本地桌面端或 CLI 中直接调用生成式模型创建 AI 视频。文章详细区分了 ChatGPT 网页版插件目录与 Codex 本地代理的架构差异,明确了安装路径、OAuth 认证流程及 Canvas 画布工作流。该更新旨在解决开发者在 ChatGPT 生态内调用视频生成模型(如 Seedance, Wan 3.0 等)的碎片化问题,强调 Pro 及以上订阅计划对自动化工作流的必要性。

Topview官方 / ADK编译 5 分钟
产品动态 2026-09-06

Adobe Photoshop 2025 图像分辨率优化指南:超分辨率与智能放大技巧

Adobe Photoshop 2025 在图像分辨率处理上带来了显著优化,重点介绍了如何利用内置的“超分辨率”功能无损放大 JPEG 图像。本文详细解析了从基础图像尺寸调整到高级 Camera Raw 滤镜应用的完整流程,帮助设计师和摄影师在保持画质的前提下提升输出质量。

Upscale.media官方 / ADK编译 4 分钟
产品动态 2026-09-06

Upscale.media 发布企业级图像放大新方案:AI 驱动 4X 无损画质升级

Upscale.media 正式推出针对企业场景的图像放大解决方案,利用先进 AI 技术实现最高 4X 倍无损画质增强。该工具支持 PNG、JPEG、WebP 等多种格式,具备批量处理与 API 集成能力,旨在帮助企业在营销物料、产品摄影及社交媒体内容中提升视觉专业度,强化品牌信任感。

Upscale.media官方 / ADK编译 3 分钟
产品动态 2026-09-06

2026 高尔夫电动滑板车七大设计趋势:从便携通勤到智能生态的全面革新

Accio Work 发布 2026 年高尔夫电动滑板车七大设计趋势报告,涵盖城市通勤便携化、复古美学融合、全集成智能控制、全地形越野能力、极简主义设计、可持续生态材料以及模块化定制功能。这些设计不仅提升了高尔夫运动的效率与体验,更重新定义了现代高尔夫玩家的移动生活方式。

Accio Work官方 / ADK编译 3 分钟