百度

32 篇面经507 道面试题

已筛选

507 道题

排序:

1186
平时通过哪些渠道学习技术?
项目与综合面试能力成长与学习方法
经历介绍
1223
从大模型实习转向智驾决策规划岗位有哪些共同点和可迁移能力?
项目与综合面试能力成长与学习方法
行为面
1224
LoRA 的低秩矩阵如何初始化?
模型训练与对齐参数高效微调
原理机制
进阶
1225
在多大规模的评估集上评测,评估集如何获得?
AI 应用工程与治理评测体系与实验设计
项目深挖
进阶
1226
采用 SFT 和 GRPO 后相对原模型改了什么,数据层面有哪些问题和修改?
模型训练与对齐强化学习与奖励
项目深挖
进阶
1227
模型最终输出的具体结果是什么?
模型基础与推理模型选型与能力边界
项目深挖
进阶
1229
不同项目为什么分别选择 PPO 和 DDPG?
模型训练与对齐强化学习与奖励
比较选型
进阶
1230
DDPG 项目的 reward 如何设计?
模型训练与对齐强化学习与奖励
方案设计
进阶
1231
智驾场景中如何处理交互博弈、保守策略与多种行为风格?
模型训练与对齐强化学习与奖励
方案设计
进阶
1232
行为风格如何输入智能体,输入是连续值还是离散值?
模型训练与对齐强化学习与奖励
原理机制
进阶

另有 1 篇多公司合集,可在面经记录中查看。