模型训练与对齐

9 个专题 · 270 道题

已筛选

270 道题

排序:

3623
微调出现复读或幻觉时如何排查和处理?
模型训练与对齐训练框架、调参与排障
故障排查
进阶
3640
多轮对话训练时如何处理过长上下文?
模型训练与对齐预训练、续训与 SFT
方案设计
进阶
3641
Agentic Training 的完整流程是什么?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3681
LLM 如何通过训练学会调用外部工具?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3684
Scaling Law 与大模型涌现能力分别是什么,有什么关系?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3716
DeepSeek V3 的训练过程有哪些关键步骤?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3717
DeepSeek R1 的训练过程有哪些关键步骤?
模型训练与对齐强化学习与奖励
原理机制
进阶
3759
Agent 的训练数据如何构建?
模型训练与对齐训练数据构建与治理
方案设计
进阶
3760
Tool Calling 的训练数据应包含哪些类型?
模型训练与对齐训练数据构建与治理
方案设计
进阶
3761
如何利用真实数据进行模型优化?
模型训练与对齐训练数据构建与治理
方案设计
进阶