跳到主要内容
面试之前,先来面栈
搜索
题库
/
模型基础与推理
推理优化与模型压缩
8
个专题 ·
179
道题
专题概览
题目列表
179
推理优化与模型压缩
继续复习
→
待复习
0
问题类型
问题类型
比较选型
方案设计
故障排查
经历介绍
项目深挖
原理机制
问题类型
技术难度
技术难度
基础
进阶
深入
技术难度
复习状态
复习状态
未标记
待复习
已掌握
复习状态
已筛选
清除筛选
共
23
道题
开始复习 →
排序:
排序
相关面经最多
题集收录最多
题号顺序
最新更新
题号
题目
技术难度
收录情况
复习状态
0603
模型推理时 Batch Size 如何设置?
模型基础与推理
推理优化与模型压缩
项目深挖
已有答案
面前必看
进阶
1
篇面经
模型推理时 Batch Size 如何设置?的复习状态
未标记
待复习
已掌握
›
0616
如何解决模型像复读机一样重复生成的问题?
模型基础与推理
推理优化与模型压缩
故障排查
已有答案
面前必看
进阶
1
篇面经
1
份题集
如何解决模型像复读机一样重复生成的问题?的复习状态
未标记
待复习
已掌握
›
1665
上下文压缩后 KV Cache 是否失效?
模型基础与推理
推理优化与模型压缩
原理机制
已有答案
面前必看
进阶
1
篇面经
上下文压缩后 KV Cache 是否失效?的复习状态
未标记
待复习
已掌握
›
2153
大模型如何逐步生成 Token?
模型基础与推理
推理优化与模型压缩
原理机制
已有答案
面前必看
进阶
1
篇面经
大模型如何逐步生成 Token?的复习状态
未标记
待复习
已掌握
›
2465
Lost in the Middle 现象是什么原理?
模型基础与推理
推理优化与模型压缩
原理机制
已有答案
面前必看
进阶
1
篇面经
1
份题集
Lost in the Middle 现象是什么原理?的复习状态
未标记
待复习
已掌握
›
2775
如何用 KV Cache 和稀疏注意力节省计算与存储?
模型基础与推理
推理优化与模型压缩
比较选型
已有答案
面前必看
进阶
1
篇面经
如何用 KV Cache 和稀疏注意力节省计算与存储?的复习状态
未标记
待复习
已掌握
›
3618
vLLM 的 PagedAttention 如何工作?
模型基础与推理
推理优化与模型压缩
原理机制
已有答案
面前必看
进阶
1
篇面经
vLLM 的 PagedAttention 如何工作?的复习状态
未标记
待复习
已掌握
›
2776
如何降低 KV Cache 空间开销,MQA 等结构起什么作用?
模型基础与推理
推理优化与模型压缩
方案设计
已有答案
面前必看
进阶
暂无面经
2
份题集
如何降低 KV Cache 空间开销,MQA 等结构起什么作用?的复习状态
未标记
待复习
已掌握
›
2836
模型量化为什么能够发挥作用?
模型基础与推理
推理优化与模型压缩
原理机制
已有答案
面前必看
进阶
暂无面经
模型量化为什么能够发挥作用?的复习状态
未标记
待复习
已掌握
›
3533
了解哪些大模型推理框架?
模型基础与推理
推理优化与模型压缩
经历介绍
已有答案
面前必看
—
暂无面经
了解哪些大模型推理框架?的复习状态
未标记
待复习
已掌握
›
0603
模型推理时 Batch Size 如何设置?
模型基础与推理
推理优化与模型压缩
项目深挖
已有答案
面前必看
进阶
1
篇面经
模型推理时 Batch Size 如何设置?的复习状态
未标记
待复习
已掌握
›
未找到相关题目
换个关键词,或清除筛选。
清除筛选
共
23
道题 · 显示 11–20 道
上一页
1
2
3
2 / 3
下一页
启用 JavaScript 后可筛选和浏览完整题库;当前显示前 10 道题。