跳到主要内容
面试之前,先来面栈
搜索
真实面经
/
极兔
极兔
1
篇面经
·
8
道面试题
收藏公司
官方招聘
↗
开始复习
→
面经
1
面试题
8
知识分类
知识分类
模型基础与推理
RAG 与知识系统
Agent 原理与系统
AI 应用工程与治理
模型训练与对齐
软件工程基础
算法与编程题
项目与综合面试
知识分类
知识专题
知识专题
工作流、状态与执行恢复
强化学习与奖励
训练数据构建与治理
Agent 基础与运行循环
Agent 框架与 Harness
知识专题
知识专题
找到
5
个专题
知识专题
✓
工作流、状态与执行恢复
✓
强化学习与奖励
✓
训练数据构建与治理
✓
Agent 基础与运行循环
✓
Agent 框架与 Harness
✓
未找到匹配专题
问题类型
问题类型
比较选型
概念解释
原理机制
问题类型
技术难度
技术难度
基础
进阶
深入
技术难度
复习状态
复习状态
未标记
待复习
已掌握
复习状态
已筛选
清除筛选
共
8
道题
开始复习 →
排序:
排序
相关面经最多
题集收录最多
题号顺序
最新更新
题号
题目
技术难度
收录情况
复习状态
0058
Agent 是什么,由哪些核心能力和组件组成?
Agent 原理与系统
Agent 基础与运行循环
概念解释
已有答案
面前必看
基础
1
篇面经
2
份题集
Agent 是什么,由哪些核心能力和组件组成?的复习状态
未标记
待复习
已掌握
›
0117
何时沿用开源 Agent 框架,何时选择自行封装或从零开发?
Agent 原理与系统
Agent 框架与 Harness
比较选型
已有答案
面前必看
进阶
1
篇面经
1
份题集
何时沿用开源 Agent 框架,何时选择自行封装或从零开发?的复习状态
未标记
待复习
已掌握
›
0169
RLHF/PPO 中 Actor、Critic、Reward Model 和 Reference Model 的职责是什么,为什么需要 KL 约束?
模型训练与对齐
强化学习与奖励
原理机制
已有答案
面前必看
进阶
1
篇面经
RLHF/PPO 中 Actor、Critic、Reward Model 和 Reference Model 的职责是什么,为什么需要 KL 约束?的复习状态
未标记
待复习
已掌握
›
0514
PPO 算法原理是什么?
模型训练与对齐
强化学习与奖励
原理机制
已有答案
面前必看
进阶
1
篇面经
PPO 算法原理是什么?的复习状态
未标记
待复习
已掌握
›
0607
GRPO 和 DAPO 有什么区别?
模型训练与对齐
强化学习与奖励
比较选型
已有答案
面前必看
进阶
1
篇面经
GRPO 和 DAPO 有什么区别?的复习状态
未标记
待复习
已掌握
›
0608
组内样本全对或全错有什么问题,DAPO 如何处理?
模型训练与对齐
训练数据构建与治理
原理机制
已有答案
面前必看
进阶
1
篇面经
组内样本全对或全错有什么问题,DAPO 如何处理?的复习状态
未标记
待复习
已掌握
›
0609
Reward Model 常用什么结构,与 Value Model 有什么区别?
模型训练与对齐
强化学习与奖励
比较选型
已有答案
面前必看
进阶
1
篇面经
Reward Model 常用什么结构,与 Value Model 有什么区别?的复习状态
未标记
待复习
已掌握
›
0610
ReAct 与普通函数调用、工作流编排有什么区别?
Agent 原理与系统
工作流、状态与执行恢复
比较选型
已有答案
面前必看
进阶
1
篇面经
ReAct 与普通函数调用、工作流编排有什么区别?的复习状态
未标记
待复习
已掌握
›
0058
Agent 是什么,由哪些核心能力和组件组成?
Agent 原理与系统
Agent 基础与运行循环
概念解释
已有答案
面前必看
基础
1
篇面经
2
份题集
Agent 是什么,由哪些核心能力和组件组成?的复习状态
未标记
待复习
已掌握
›
未找到相关题目
换个关键词,或清除筛选。
清除筛选
共
8
道题 · 显示 1–8 道
上一页
1
1 / 1
下一页
启用 JavaScript 后可筛选和浏览完整题库;当前显示前 10 道题。