科大讯飞

2 篇面经32 道面试题

已筛选

32 道题

排序:

1892
模型训练过程中遇到过哪些问题?
模型训练与对齐预训练、续训与 SFT
项目深挖
进阶
2704
如何根据业务目标设计强化学习奖励?
模型训练与对齐强化学习与奖励
方案设计
进阶