模型训练与对齐

9 个专题 · 270 道题

已筛选

270 道题

排序:

2491
4B 模型推理时的显存占用是多少,如何估算?
模型训练与对齐分布式训练与计算硬件
方案设计
进阶
2632
DAPO 的改进解决了什么问题?
模型训练与对齐强化学习与奖励
原理机制
进阶
2640
除了幻觉,大模型还存在哪些问题?
模型训练与对齐预训练、续训与 SFT
概念解释
基础
2687
RL 训练数据如何构建,能否直接复用 SFT 数据?
模型训练与对齐训练数据构建与治理
比较选型
进阶
2689
强化学习如何选择有效难度的样本并提升复杂任务探索?
模型训练与对齐强化学习与奖励
方案设计
进阶
2698
项目训练集有多少数据,数据规模如何确定?
模型训练与对齐训练数据构建与治理
项目深挖
进阶
2911
LoRA、QLoRA 与全量微调如何选择?
模型训练与对齐参数高效微调
比较选型
进阶
3654
强化学习任务的奖励函数如何设计?
模型训练与对齐强化学习与奖励
方案设计
进阶
3655
如何判断强化学习训练质量是否达标?
模型训练与对齐Verifier 与训练评测
效果评估
进阶
3666
图生图模型的微调数据如何构建?
模型训练与对齐训练数据构建与治理
方案设计
进阶