RAG 的 Top-K 如何选择和验证,怎样权衡召回不足与噪声?

暂无参考答案

未标记

本题目录

相关面经

5

阿里巴巴

AI 全栈开发工程师
一面
查看原面经 →
项目追问
切完以后,检索过程中,如果是做 RAG 系统的话,一般会检索多少条出来?top k 等于 6 或 8 是吧?(追问)这个 6 和 8 的数字你是怎么定出来的?为什么不用 3 或者 1 或者 5?(追问)为什么在你的评测里面 8 或 6 会比 3 好?8 难道不会给他更多干扰项、不会产生幻觉吗?比 3 好的原因是什么?(追问)设置小的时候召回效果不好,你觉得可能是哪几个方面做得不好?

腾讯音乐

后端开发工程师
实习一面
查看原面经 →
想问一下在优化 RAG 检索精度时,你针对文档的分割大小和检索的 topK 参数进行了测试和调优,那文档大小设置得过大或过小,分别会带来哪些负面影响?在确定最优参数组合的时候,你主要权衡了哪些因素?

快手

大模型算法工程师
实习二面
查看原面经 →
向量库检索出的Top-K结果,如果K值设置得过大,对后续的生成质量有哪些负面影响?

快手

Agent 应用开发工程师
实习一面
查看原面经 →
rerank后一般返回几个块?
(追问)为什么选择这个数量?有没有做过验证?
rerank后的topK截断是怎么做的?
(追问)为什么是这个值?有没有尝试过其他策略?

字节跳动

大模型应用算法工程师
实习
查看原面经 →
向量库检索出的Top-K结果,如果K值设置得过大,对后续的生成质量有哪些负面影响?

收录题集

1

八股集锦(高频问题)

小熊饼干_ · 个人整理 · 收录 2 道

查看题集 →

RAG召回数量(Top k)过大过小分别有什么影响

如何根据业务场景选择合适的Top k

相关题目

4