八股集锦(高频问题)
大模型主要基于什么架构?有哪些部分组成
原题为什么大模型大多是decoder-only的架构?
原题大模型是如何训练/获取知识的?
原题什么是Transformer
原题Transformer的优缺点是什么?
原题什么是Transformer的编码器和解码器?分别有什么用
原题Decoder-only模型在训练阶段和推理阶段的输入格式有什么不同?
原题Transformer的Decoder阶段的多头自注意力和Encoder的多头自注意力有什么区别?
原题为什么要Decoder自注意力要进行Mask?
原题Transformer掩码注意力机制具体是怎么做的?
原题Transformer的并行化体现在哪些地方?Decoder端可以做并行化吗?
原题Transformer中Attention的本质是什么?
原题自注意力的计算方式和复杂度?
原题为什么自注意力计算要除$$\sqrt{d_k} $$
原题介绍一下Transformer QKV的计算?
原题(追问)为什么要分成QKV,怎么计算的?同一个token向量是一样的吗?
原题自注意力中多头的好处?
原题为什么在进行多头注意力的时候需要对每个head进行降维
原题交叉注意力你如何理解,与自注意力有什么区别。
原题什么是MoE模型?与Dense模型有什么区别?
原题MoE模型有什么优势和劣势?
原题为什么大模型都开始转向MoE?
原题什么是大模型的幻觉?
原题为什么大模型会产生幻觉?
原题如何解决大模型的幻觉问题?
原题什么是Prompt Engineering?
原题提示词可以分几个部分,分别起什么作用?
原题如何优化大模型的提示词?
原题如何评价一个提示词的好坏?
原题提示词如何进行压缩
原题大模型常见的解码方式
原题Top p、Top k、Temperature(大模型解码参数)
原题什么是投机解码,与自回归有什么区别?
原题大模型解码推理的两个阶段是什么?
原题(追问)为什么要做Prefill
原题KV Cache的动机和原理
原题KV Cache的优缺点
原题为什么有K和V Cache,没有Q Cache
原题为什么KV cache显存利用率很低
原题如何优化KV Cache,有什么方式
原题LLM的复读机现象是什么,如何解决?
原题DeepSeek模型系列演变
原题DeepSeek如何实现MoE机制
原题DeepSeek中的MLA原理是什么
原题DeepSeek中的MTP如何实现
原题DeepSeek热门版本训练的关键步骤
原题DeepSeekV3训练关键步骤
原题Deepseek R1 训练关键步骤
原题Deepseek的百万Token窗口和RAG各有什么优劣?
原题用过OpenClaw吗
原题OpenClaw相比其他智能体框架的区别在哪里
原题OpenClaw的记忆系统是如何设计的?
原题OpenClaw还有什么问题没解决/局限性在哪里
原题RAG的基本流程
原题RAG有什么用/解决了什么问题?
原题RAG有哪些痛点问题/能够做哪些优化?
原题RAG与一般的微调方案相比有什么优势?/在微调和RAG之间为什么优选RAG
原题知道Query重构吗,有哪些重构的方法?
原题文档解析的作用是什么,解析不好会造成什么影响?
原题不同格式的文档如何进行文档解析
原题多级文档怎么保证在检索阶段保留层级信息?
原题如何评价解析效果?
原题为什么要Chunking?
原题Chunking越大和越小各自存在什么问题?
原题常见的Chunking方案
原题如何设计一个好的Chunking方案
原题如何根据chunk建立索引定位原文位置?
原题如何将一个完整的段落和语义单元拆分到不同的chunks中?
原题如何验证Chunking的质量
原题RAG如何做索引?
原题常见的向量索引算法有哪些
原题在大规模文档嵌入建立索引的时候,存在很多相似性文档如何处理。
原题RAG如何做检索(BM25,Embedding,混合检索)
原题多路召回RRF合并融合原理是什么
原题关键词检索和向量检索的比例在不同场景下如何确定
原题不同检索方式各有什么问题
原题RAG文档很多如何保持检索的性能
原题RAG召回数量(Top k)过大过小分别有什么影响
原题如何根据业务场景选择合适的Top k
原题什么是向量化(Embedding),有什么作用?
原题你了解哪些Embedding模型
原题Embedding模型在下游任务中存在什么缺陷
原题重排序阶段的作用是什么/精排和粗排的区别是什么?
原题Rerank模型和Embedding模型有什么区别
原题为什么要做Rerank/Rerank模型的作用
原题为什么不只做Rerank,而是对粗粒度的结果做精排?
原题两阶段粗排序+精排序有什么优缺点?
原题GraphRAG解决了RAG的什么问题?
原题GraphRAG知识图谱的建立过程
原题GraphRAG常见的检索样式有哪些?
原题GraphRAG相比传统的RAG有什么劣势
原题还有哪些GraphRAG算法,分别解决原始GraphRAG的什么问题
原题
暂无题目