rag面试题之多轮对话时的上下文依赖检索设计

一句话回答

多轮 RAG 难点:用户后续提问是省略式、指代式(“那它有什么限制?”),直接拿当前这句话去检索会语义缺失,召回垃圾文档;

核心思路:把历史对话信息合理融入检索环节,还原完整用户意图,同时不能把全部历史直接塞进检索,避免噪声膨胀。

总结的说法:

多轮对话检索最大问题是用户存在指代、省略,直接拿当前问句检索效果很差。

主流方案是 Query 重写:结合最近几轮对话,调用 LLM 把当前问题补全为完整查询(提问),拿补全后的语句做知识库检索;

注意区分:检索用改写后的 query,最终大模型生成回答,仍然要带上原始完整对话。同时要限制对话轮次做截断,防止上下文无限膨胀

难点解析:检索器的每一次检索都是独立的,它不会记住历史的,所以我们要进行 query 重写,所谓的 query 重写,就是把问题给小型的大模型,让其润色,比如:

用户:BGE‑M3 怎么做混合检索?

AI:BGE‑M3 可以同时输出稠密向量与稀疏向量,再用 RRF 融合结果……

用户:那参数怎么调?(当前用户提问,有代词 “那”)

当用户问: 那参数怎么调? 时,如果直接给向量模型,向量模型是不知道这个那指的是什么的,需要让模型润色为如下问题: BGE‑M3做混合检索时相关参数如何调优

然后问题输入给参数比较大的大模型时,需要将历史所有对话(原始的)+ 用户当前原始的对话一起输入给大模型,这样的问题不要润色,因为大模型可以理解。

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包

打赏作者

闫哥大数据大模型

你的鼓励将是我创作的最大动力

¥1 ¥2 ¥4 ¥6 ¥10 ¥20
扫码支付:¥1
获取中
扫码支付

您的余额不足,请更换扫码支付或充值

打赏作者

实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值