2025_NIPS_RAGRouter: Learning to Route Queries to Multiple Retrieval-Augmented Language Models

文章主要内容总结

该研究聚焦检索增强生成(RAG)场景下的大语言模型(LLM)路由问题,提出了首个RAG感知的路由框架RAGRouter。核心解决现有路由方法依赖静态参数知识、忽略检索文档动态影响的缺陷,通过融合文档嵌入、RAG能力嵌入与对比学习,捕捉RAG引发的模型知识表征变化,为每个查询-文档对选择最优LLM。实验覆盖5个知识密集型任务、15个开源/闭源LLM,验证了RAGRouter在性能上超越最佳单LLM和非RAG感知路由方法,且通过阈值机制实现低延迟约束下的性能-效率平衡。

核心创新点

  1. 首次定义RAG场景下的LLM路由问题:明确将检索文档与模型RAG能力纳入路由决策,突破传统路由仅依赖查询与模型静态匹配的局限。
  2. RAG感知的架构设计:整合文档编码器、交叉编码器捕捉文档语义与查询-文档交互,引入RAG能力嵌入层建模模型利用外部知识的固有能力。
  3. 双对比学习优化:提出跨设置对比(CSC)和内设置对比(ISC)机制,分别捕捉RAG与非RAG场景间、同一场景内的模型性能差异,精准建模知识表征迁移。
  4. 延迟感知扩展设计:基于分数阈值的路由机制,在牺牲少量精度的前提下显著降低延迟,适配资源受限场景。

翻译部分(Markdown格式)

Abstract

检索增强生成(RAG)显著提

评论
添加红包

请填写红包祝福语或标题

红包个数最小为10个

红包金额最低5元

当前余额3.43前往充值 >
需支付:10.00
成就一亿技术人!
领取后你会自动成为博主和红包主的粉丝 规则
hope_wisdom
发出的红包
实付
使用余额支付
点击重新获取
扫码支付
钱包余额 0

抵扣说明:

1.余额是钱包充值的虚拟货币,按照1:1的比例进行支付金额的抵扣。
2.余额无法直接购买下载,可以购买VIP、付费专栏及课程。

余额充值