找回密码
 加入怎通
查看: 395|回复: 0

全面提升 RAG 质量!Zilliz 携手智源集成 Sparse Embedding、Reranke

[复制链接]
ningxueqin 发表于 2024-07-14 12:29:29 | 显示全部楼层 |阅读模式
  Zilliz 持续为 AI 应用开发者赋能!0 N" G* A% z: }. ?0 i3 W- T( g) P; v
0 |' {: z7 }% G4 }
0 A# _& U6 e# i6 f
  近期,Zilliz 与智源研究院达成合作,将多种 BGE(BAAI General Embedding) 开源模型与开源向量数据库 Milvus 集成。得益于 Milvus 2.4 最新推出的 Sparse Vector(稀疏向量)和 Multi-vector(多向量)支持,开发者获得了多种选择,不仅有业界广泛采用的 Dense Embedding(稠密向量模型),还能使用 BGE 最新推出的 Sparse Embedding(稀疏检索模型)、Reranker(重排序) 模型。开发者可以轻松组合这些工具构建更加强大的召回方案,覆盖语义检索、全文检索和精排的能力。
* x. q4 V9 ]4 [" |5 B* |0 w/ Z" i4 c0 o

. h7 h2 r2 Q/ }6 H2 ]  BGE 与 Milvus 的集成在全面提升 RAG 质量的同时兼具灵活性,国产向量数据库有哪些可以更好地为 AI 应用开发者服务。
) F6 y4 y; h3 ]. O7 d' n- o& v$ d& K, @5 o* A4 N
! s0 z( [2 e; S1 D) v7 G
  01.Sparse Embedding 和 Reranker:提升 RAG 的新趋势
- B8 ?. K) p* o% ^  x! x: c& H+ Y5 v: ~3 n
, \0 c8 y. F& S# H! \5 F* w
  RAG(Retrieval Augmented Generation,检索增强生成)是一种利用检索外部知识库的信息来增强大语言模型准确性和可靠性的技术。RAG 已经被证明能够有效解决一系列阻碍大模型应用的核心问题(例如出现幻觉、时效性差、专业领域知识不足、数据安全问题等)。而 Embedding 模型和向量数据库是实现这一方案的关键,更好的模型、功能更丰富的向量数据库,能够有效提升 RAG 的回复质量,帮助大语言模型实现更好的终端问答体验。
0 p( q  J! u" P0 G# ~3 O
/ h# z( d! x5 `, e* g
) F/ `: b$ D- D- N% j4 j/ Z% L
  然而,由于基础 Dense Embedding 和向量召回方案的限制,一些场景下RAG 最终所呈现的效果还不尽如人意。目前,业界倾向于采取两种方案来提升 RAG 的问答质量:
5 _% C0 \9 h3 |
' z6 ^+ e$ @' m5 k, G4 P
" Z  H# C5 Y3 v5 p8 G1 K9 y
  方案一,使用 Sparse Vector 配合 Dense Vector 进行两路召回的方式。其中,Sparse Vector 可以覆盖传统全文检索的能力,帮助识别和捕捉特定的关键词,而 Dense Vector 则可以更有效地抓住文本中的整体语义信息。通过将这两种向量召回的结果整合,可以获得更丰富、更全面的信息,从而提升 RAG 的效果。" B: L8 P( B. C" w

/ c: ^( z$ c. |" V- w1 w

4 p- s, O5 y6 T; c, U7 @( D! Y  方案二,使用 Cross-Encoder Reranker(交叉编码重排序) 作为第二层的精排。首先使用 Dense Vector、Sparse Vector 或二者的组合进行粗排;随后通过使用 Reranker 模型对第一阶段的结果进行进一步的筛选和排序,以提高最终结果的质量。
' U3 J# i% e5 R, z7 {
: _, p! v. X$ ?2 c  H: z" X
+ S4 O6 u9 p" V0 p. P; S/ i: h; r4 b
  值得注意的是,方案一既可以独立使用,即采用基于规则的算法来合并两路召回的结果,例如常用的 RRF Reciprocal Rank Fusion (RRF),也可以叠加方案二使用,即采用 Cross-Encoder Reranker 对两路结果合并重新排序。/ [$ I. C( n0 q- |+ n

. C3 _* w$ N, k: Z3 Q- l, |

% a) h3 n. u, A) `7 m  02.Milvus 携手 BGE:灵活解决 RAG 的质量难题/ N: `  l+ Y2 n
9 r( _$ Q5 t! c
3 F2 o6 J1 ?0 c- \' B2 R
  Milvus 是一款面向 AI 应用,服务向量搜索和非结构化数据管理的开源向量数据库。它最初由 Zilliz 公司发起,并在 2019 年开源。自推出以来,Milvus 在 AI 开发者社区和企业用户中大受欢迎并被广泛采用,在 GitHub 上拥有超过 26,000 个星标和 260 多位贡献者,全球下载和安装量超过 2000 万次,已成为全球使用最广泛的向量数据库之一。
' A9 X; j9 ?$ q( j3 T+ `; G$ P
' C; a" U; G* K1 X" m! V) J5 P9 V& g
$ K0 Q2 t1 y, y1 I# C5 e
  不久前,Zilliz 创始人兼 CEO 星爵在 NVIDIA GTC 大会上正式发布了 Milvus 2.4 版本,堪称业界的革命性升级。除了被热烈讨论的基于 GPU 的向量索引和搜索加速能力,对 Sparse Vector 和 Multi-Vector 的支持也是一大亮点。Milvus 与智源 BGE 的集成不仅一次性聚集了提升 RAG 质量所需的 Sparse Embedding、多路召回、Reranker 能力,更是为开发者提供了多种类、多层次的召回方案,帮助开发者根据实际需求灵活地构建AI应用。, X% X+ E% D2 B2 @

+ G& G" H. \3 o4 F* f. G
4 J7 S" a( D' K
  此次与 Milvus 携手的 BGE 是由智源研究院打造的通用语义模型。自 2023 年 8 月首次发布以来,智源团队陆续推出了中英文模型 BGE v1.0、v1.5、以及支持多达 100 多种语言和多种召回方式的 BGE-M3 模型。截至目前,BGE 系列模型全球下载量已经超过 1500万,位居国内开源 AI 模型首位。BGE-M3 模型更是一度跃居 Hugging Face 热门模型前三名。在最新推出的 Milvus 2.4 客户端中,为 BGE 模型提供了简单易用的函数封装。开发者可以更加方便地使用多种 BGE 开源模型,配合 Milvus 向量数据库构建多路、多级的召回方案,全面提升 RAG 质量。, B- J" A5 l! m. d3 @
8 ^9 G9 q1 K2 H) u- @+ z* [

暂时无法加载帖子列表

回复

使用道具 举报

    您需要登录后才可以回帖 登录 | 加入怎通

    本版积分规则

    QQ|手机版|小黑屋|网站地图|真牛社区 ( 苏ICP备2023040716号-2 )

    GMT+8, 2026-8-6 20:38 , Processed in 0.056918 second(s), 52 queries , Gzip On.

    免责声明:本站信息来自互联网,本站不对其内容真实性负责,如有侵权等情况请联系420897364#qq.com(把#换成@)删除。

    Powered by Discuz! X3.5

    快速回复 返回顶部 返回列表