美团

22 篇面经248 道面试题

已筛选

248 道题

排序:

2687
RL 训练数据如何构建,能否直接复用 SFT 数据?
模型训练与对齐训练数据构建与治理
比较选型
进阶
2688
RL 训练初期奖励先降后升时,如何解释和排查?
模型训练与对齐强化学习与奖励
故障排查
进阶
2689
强化学习如何选择有效难度的样本并提升复杂任务探索?
模型训练与对齐强化学习与奖励
方案设计
进阶
2696
项目为什么选择当前基座模型或架构?
模型基础与推理模型选型与能力边界
比较选型
进阶
2710
求数组中的第 k 大元素。
算法与编程题排序、查找与 Top-K
代码题
进阶
2717
思维链 CoT 的作用是什么?
AI 应用工程与治理Prompt 与结构化输出
原理机制
基础
2731
常用集合有哪些,各自适合什么业务场景?
软件工程基础C/C++、Go 与编译
比较选型
基础
2743
结构化记忆和文本记忆如何分工并避免重复?
Agent 原理与系统记忆系统
系统设计
进阶
2744
Agent 记忆与当前上下文发生冲突时,如何判断、使用和更新?
Agent 原理与系统记忆系统
故障排查
进阶
2745
压缩丢失工具调用历史导致重复调用时,如何处理?
Agent 原理与系统上下文工程
故障排查
进阶