百度

32 篇面经507 道面试题

已筛选

507 道题

排序:

1233
如何证明模型学到了不同风格的影响,并评估效果?
模型训练与对齐强化学习与奖励
方案设计
进阶
1234
PPO 与 TRPO 有何区别?
模型训练与对齐强化学习与奖励
比较选型
进阶
1235
训练中出现策略坍缩如何解决?
模型训练与对齐强化学习与奖励
故障排查
进阶
1236
如何体现和评估策略鲁棒性?
模型训练与对齐强化学习与奖励
方案设计
进阶
1237
给定金额和硬币种类,计算组成金额的方案数。
算法与编程题动态规划、贪心与回溯
代码题
进阶
1240
Agent 如何隔离不同任务?
AI 应用工程与治理安全、权限与人工介入
系统设计
进阶
1247
MCP 与 Skill 有什么区别?
Agent 原理与系统Skills 能力系统
比较选型
基础
1257
XSS 与 CSRF 的原理是什么?
软件工程基础安全与认证
原理机制
进阶
1270
项目使用什么大模型或哪类模型?
模型基础与推理模型选型与能力边界
经历介绍
1290
检索做了哪些优化,如何验证提升?
RAG 与知识系统召回策略与检索
项目深挖
进阶

另有 1 篇多公司合集,可在面经记录中查看。