412 字
约 1 分钟
1
为什么项目用的rag是向量检索➕bm25+知识图谱,但是测评里却只测了向量和bm25和这两者混合?

为什么项目用的rag是向量检索➕bm25+知识图谱,但是测评里却只测了向量和bm25和这两者混合?

回答:知识图谱是后续加的,rag测评基本测的话也就是两种,一种是chunk的切分策略,一种是向量化模型的选择。而前者的测评需要大量的前置工作,所以我们选择了后者,我当时面字节的时候就被问了你为什么要选择这个向量化模型,那你口说无凭肯定要通过具体的benchmark去给出选择这个向量化模型的选择...

字数: 261 | 语雀原文


回答:知识图谱是后续加的,rag测评基本测的话也就是两种,一种是chunk的切分策略,一种是向量化模型的选择。而前者的测评需要大量的前置工作,所以我们选择了后者,我当时面字节的时候就被问了你为什么要选择这个向量化模型,那你口说无凭肯定要通过具体的benchmark去给出选择这个向量化模型的选择,测评的核心就是看向量检索的指标,bm25因为与向量模型无关,所以测出的召回指标应该都是一样的,但是混合效果应该是有差别,按理来说加完知识图谱应该再测一轮混合效果的,但后面没测属于是懒了,到时候可以说这个知识图谱是可选功能,核心测评逻辑还是在于向量化模型的选择。

为什么项目用的rag是向量检索➕bm25+知识图谱,但是测评里却只测了向量和bm25和这两者混合?
http://www.clxhxhhr.top/posts/747/
作者
clxstart
发布于
2026-09-18
许可协议
CC BY-NC-SA 4.0
评论
0 条
还没有评论,先写一条吧。