百度

32 篇面经507 道面试题

已筛选

507 道题

排序:

1735
决策项目采用多智能体协同有哪些优势和难点?
模型训练与对齐强化学习与奖励
项目深挖
进阶
1736
强化学习决策算法的输入是什么,还使用哪些输入特征?
模型训练与对齐强化学习与奖励
项目深挖
进阶
1737
项目中 Transformer 的表示是显式还是隐式,属于中间结果还是最终输出?
模型基础与推理模型架构与表示
项目深挖
进阶
1738
项目中的 Transformer 特征模块具体如何实现?
模型基础与推理模型架构与表示
项目深挖
深入
1739
强化学习项目是否与仿真环境交互,各项目是否相同?
模型训练与对齐强化学习与奖励
项目深挖
进阶
1740
没有原有仿真环境时,是否仍能实现当前强化学习模型?
模型训练与对齐强化学习与奖励
方案设计
进阶
1741
项目如何使用 MHA 做特征增强?
模型基础与推理模型架构与表示
项目深挖
进阶
1742
项目奖励函数是稀疏还是稠密的,具体如何设计?
模型训练与对齐强化学习与奖励
项目深挖
进阶
1743
奖励项重要程度不同时,如何平衡各项权重?
模型训练与对齐强化学习与奖励
项目深挖
进阶
1744
项目为什么没有采用 TD3?
模型训练与对齐强化学习与奖励
比较选型
进阶

另有 1 篇多公司合集,可在面经记录中查看。