深信服

7 篇面经96 道面试题

已筛选

96 道题

排序:

2697
SFT、DPO、PPO 与 GRPO 的目标、机制和适用条件如何比较?
模型训练与对齐强化学习与奖励
比较选型
进阶
2698
项目训练集有多少数据,数据规模如何确定?
模型训练与对齐训练数据构建与治理
项目深挖
进阶
2699
如何评估微调或训练后模型的效果?
模型训练与对齐Verifier 与训练评测
方案设计
进阶
2705
训练时如何选择关键超参数并判断其影响?
模型训练与对齐训练框架、调参与排障
方案设计
进阶
2706
如何构建 chosen/rejected 偏好对,模型答案优于标注答案时如何处理?
模型训练与对齐偏好对齐
方案设计
进阶
2707
DeepSeek-R1 的主要技术贡献是什么?
模型基础与推理模型架构与表示
原理机制
进阶
3065
自研 ID 生成方案相比 UUID 和雪花算法有什么优势?
软件工程基础分布式系统与一致性
比较选型
进阶
3066
项目三层缓存如何分层,各层承担什么职责?
软件工程基础Redis 与缓存
项目深挖
进阶
3067
如何保证多级缓存之间的数据一致性?
软件工程基础Redis 与缓存
方案设计
深入
3068
系统异常重启时如何避免缓存数据异常?
软件工程基础Redis 与缓存
方案设计
进阶