大模型算法工程师(模型微调)面经
完整信息
本篇目录
1️⃣ 拷打项目:简历上有一段包装minimind的项目,面试官主要问的这一个(因为其他两个项目和大模型关联不太大,但面试官也问了一些细节的问题)
数据集有多大?多少条数据
你认为在训练过程中比较重要的参数是哪些?答的学习率和lora的秩
训练模型的过程中,会看哪些指标来判断模型训练的效果?
样本对choose,rejected的构建,会不会出现模型结果比真实回答更好的情况?
2️⃣ 常规八股
deepseek-R1中的核心贡献
介绍GRPO,PPO,DPO的区别
同策略和异策略
3️⃣ 在校的经历
竞赛承担的角色,有没有后续的一些成果转化?
小论文投了吗
4️⃣ 实习情况
能实习多久,工作地点
5️⃣ 反问
问了面试官主要的工作内容,是对模型做微调还是优化提示词?说主要是对模型做微调,弄一个客服的agent接到企业微信里
本篇目录
- 01
1️⃣ 拷打项目:简历上有一段包装minimind的项目,面试官主要问的这一个(因为其他两个项目和大模型关联不太大,但面试官也问了一些细节的问题)
- 02
数据集有多大?多少条数据
- 03
你认为在训练过程中比较重要的参数是哪些?答的学习率和lora的秩
- 04
训练模型的过程中,会看哪些指标来判断模型训练的效果?
- 05
样本对choose,rejected的构建,会不会出现模型结果比真实回答更好的情况?
- 06
deepseek-R1中的核心贡献
- 07
介绍GRPO,PPO,DPO的区别
- 08
同策略和异策略
- 09
竞赛承担的角色,有没有后续的一些成果转化?
- 10
小论文投了吗
- 11
能实习多久,工作地点
- 12
问了面试官主要的工作内容,是对模型做微调还是优化提示词?说主要是对模型做微调,弄一个客服的agent接到企业微信里
