已筛选

3697 道题

排序:

3649
如何降低多头注意力的计算开销?
模型基础与推理推理优化与模型压缩
方案设计
进阶
3650
RoPE 是什么,解决什么问题?
模型基础与推理Tokenizer 与位置编码
原理机制
基础
3651
如果自行构建 Harness,需要完成哪些工作?
Agent 原理与系统Agent 框架与 Harness
系统设计
进阶
3653
项目知识库做过哪些性能优化?
RAG 与知识系统RAG 评测与故障排查
项目深挖
进阶
3681
LLM 如何通过训练学会调用外部工具?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3682
WebRTC 与 WebSocket 在实时 AI 对话中有什么区别,如何选择?
软件工程基础网络与浏览器
比较选型
进阶
3683
大语言模型与传统 NLP 模型有什么区别?
模型基础与推理模型架构与表示
比较选型面前必看
基础
3684
Scaling Law 与大模型涌现能力分别是什么,有什么关系?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3685
Tokenizer 的原理是什么,如何影响大模型训练与推理?
模型基础与推理Tokenizer 与位置编码
原理机制面前必看
进阶
3686
大模型常见解码策略有哪些,贪心、Beam Search 与采样如何选择?
模型基础与推理推理与解码
比较选型
进阶