顺丰

7 篇面经71 道面试题

已筛选

71 道题

排序:

2536
Agent 任务规划主要包含哪些内容?
Agent 原理与系统规划、推理与任务执行
概念解释
基础
2913
什么情况下 GRPO 效果较差?
模型训练与对齐强化学习与奖励
故障排查
进阶
3047
SFT 的完整执行流程与训练数据集如何构建?
模型训练与对齐训练数据构建与治理
方案设计
进阶
3449
PPO 中需要训练哪几个模型?
模型训练与对齐强化学习与奖励
原理机制
基础
3660
SFT 数据问题不够多样化时,如何改进数据集?
模型训练与对齐训练数据构建与治理
方案设计
进阶
3661
GSPO 的核心机制是什么,与 GRPO 有什么关系?
模型训练与对齐强化学习与奖励
原理机制
进阶
0014
团队如何分工,你在项目中负责哪些部分?
项目与综合面试项目背景、架构与职责
项目深挖
基础
0051
多轮对话变长时,如何控制上下文长度并选择压缩策略?
Agent 原理与系统上下文工程
方案设计面前必看
进阶
0097
团队成员或面试官与你判断不一致时,你会如何处理?
项目与综合面试团队协作与推动落地
行为面
0107
项目如何从本地部署到云端并完成上线?
AI 应用工程与治理模型服务、部署与交付
系统设计
进阶