Agent 应用开发工程师一面、二面面经
完整信息
本篇目录
7.2一面、7月3二面,挂了,我发现我总是挂在二面,这是为啥啊?二面面试官都注重什么?有懂的人来解惑一下吗
二面主要问的是 Agent 系统理解:
1、action 怎么设计
2、Agent 怎么处理长文本
3、上下文记忆的关键是什么
4、前后指令冲突怎么处理
5、harness 和 loop engineering 是什么
6、skills 为什么适合放 system 层
7、未来 Agent 的核心能力是什么
8、对 GLM-5.2、Claude Code、Codex 这类系统有什么理解
一面主要问的是 Agent 训练 / Post-training / RL 项目细节:
1、RL 前 SFT 怎么做,怎么判断 SFT 到位
2、eward 和 verifier 怎么设计
3、reward hacking 怎么发现
4、badcase 怎么回流
5、PPO 里的 value model / reward model 怎么训练
6、GRPO reward 能不能迁移到 PPO
7、Agent 任务怎么评测
8、Code Agent verifier 怎么设计 #发面经攒人品#
本篇目录
- 01
action 怎么设计
- 02
Agent 怎么处理长文本
- 03
上下文记忆的关键是什么
- 04
前后指令冲突怎么处理
- 05
harness 和 loop engineering 是什么
- 06
skills 为什么适合放 system 层
- 07
未来 Agent 的核心能力是什么
- 08
对 GLM-5.2、Claude Code、Codex 这类系统有什么理解
- 09
RL 前 SFT 怎么做,怎么判断 SFT 到位
- 10
RL 前 SFT 怎么做,怎么判断 SFT 到位
上一问 ↑ - 11
eward 和 verifier 怎么设计
- 12
reward hacking 怎么发现
- 13
badcase 怎么回流
- 14
PPO 里的 value model / reward model 怎么训练
- 15
GRPO reward 能不能迁移到 PPO
- 16
Agent 任务怎么评测
- 17
Code Agent verifier 怎么设计