RAG 的 Top-K 如何选择和验证,怎样权衡召回不足与噪声?
暂无参考答案
未标记
本题目录
相关面经
5 篇阿里巴巴
AI 全栈开发工程师一面
切完以后,检索过程中,如果是做 RAG 系统的话,一般会检索多少条出来?top k 等于 6 或 8 是吧?(追问)这个 6 和 8 的数字你是怎么定出来的?为什么不用 3 或者 1 或者 5?(追问)为什么在你的评测里面 8 或 6 会比 3 好?8 难道不会给他更多干扰项、不会产生幻觉吗?比 3 好的原因是什么?(追问)设置小的时候召回效果不好,你觉得可能是哪几个方面做得不好?
腾讯音乐
后端开发工程师实习一面
想问一下在优化 RAG 检索精度时,你针对文档的分割大小和检索的 topK 参数进行了测试和调优,那文档大小设置得过大或过小,分别会带来哪些负面影响?在确定最优参数组合的时候,你主要权衡了哪些因素?
快手
大模型算法工程师实习二面
向量库检索出的Top-K结果,如果K值设置得过大,对后续的生成质量有哪些负面影响?
快手
Agent 应用开发工程师实习一面
字节跳动
大模型应用算法工程师实习
向量库检索出的Top-K结果,如果K值设置得过大,对后续的生成质量有哪些负面影响?
收录题集
八股集锦(高频问题)
RAG召回数量(Top k)过大过小分别有什么影响
如何根据业务场景选择合适的Top k



