模型训练与对齐

9 个专题 · 270 道题

已筛选

270 道题

排序:

1854
ZeRO-3 的原理是什么?
模型训练与对齐分布式训练与计算硬件
原理机制
进阶
1855
已经使用 ZeRO-3 后,还可以采用哪些显存优化方法?
模型训练与对齐分布式训练与计算硬件
方案设计
进阶
1892
模型训练过程中遇到过哪些问题?
模型训练与对齐预训练、续训与 SFT
项目深挖
进阶
1895
简历中的分布式训练或推理具体指什么?
模型训练与对齐分布式训练与计算硬件
项目深挖
进阶
1896
项目为什么选择 GRPO 而不选择 DPO?
模型训练与对齐强化学习与奖励
比较选型
进阶
1898
实习中的 SFT 具体如何实现?
模型训练与对齐预训练、续训与 SFT
项目深挖
进阶
1971
项目微调的目标是否是让模型生成预期推理路径与执行结果?
模型训练与对齐预训练、续训与 SFT
项目深挖
进阶
1972
项目能否只用 Prompt 和时间约束工具,而不进行微调?
模型训练与对齐预训练、续训与 SFT
比较选型
进阶
1974
项目是否使用 LoRA 进行微调?
模型训练与对齐参数高效微调
项目深挖
进阶
2018
模型效果不好时,如何判断问题来自预训练、后训练还是数据?
模型训练与对齐训练框架、调参与排障
故障排查
进阶