美团

22 篇面经248 道面试题

已筛选

248 道题

排序:

2467
交叉注意力如何工作?
模型基础与推理Transformer 与注意力
原理机制
进阶
2468
GRPO 的 Loss 如何计算?
模型训练与对齐强化学习与奖励
原理机制
进阶
2469
Deep Research 如何与强化学习结合?
模型训练与对齐强化学习与奖励
方案设计
进阶
2474
GRPO 训练实际使用什么数据?
模型训练与对齐强化学习与奖励
项目深挖
进阶
2490
GRPO 相比 PPO 做了哪些改进?
模型训练与对齐强化学习与奖励
比较选型
进阶
2491
4B 模型推理时的显存占用是多少,如何估算?
模型训练与对齐分布式训练与计算硬件
方案设计
进阶
2500
AI 辅助开发如何遵守项目规范?
AI 应用工程与治理AI Coding 与研发流程
方案设计
基础
2564
使用 Vibe Coding 开发造数工具的思路是什么?
AI 应用工程与治理AI Coding 与研发流程
项目深挖
进阶
2667
如何约束并验证 AI 生成代码的质量?
AI 应用工程与治理AI Coding 与研发流程
方案设计
进阶
2675
如何判定 SFT 可以结束并进入强化学习阶段?
模型训练与对齐强化学习与奖励
方案设计
进阶