百度

32 篇面经507 道面试题

已筛选

507 道题

排序:

0273
SFT 与偏好数据如何构建,如何控制数据污染和分布偏移?
模型训练与对齐偏好对齐
方案设计
进阶
0274
Decoder-only 的 KV Cache 为什么缓存 K、V 而通常不缓存 Q?
模型基础与推理推理优化与模型压缩
原理机制
进阶
0275
如何从 KL 约束的强化学习目标推导 DPO 目标?
模型训练与对齐偏好对齐
原理机制
深入
0276
训练正常而离线评测骤降时,如何定位链路问题?
模型训练与对齐训练框架、调参与排障
故障排查
深入
0277
FlashAttention 为什么能节省显存并提速,是否改变注意力结果?
模型基础与推理推理优化与模型压缩
原理机制
进阶
0278
工业故障诊断项目如何排除测试污染与 Judge 偏差,证明训练策略收益?
模型训练与对齐Verifier 与训练评测
效果评估
深入
0279
MoE 负载均衡损失与专家路由塌缩有什么关系,如何稳定路由?
模型基础与推理模型架构与表示
故障排查
进阶
0281
项目使用了哪些工具,分别承担什么任务?
Agent 原理与系统工具调用与 Function Calling
项目深挖
进阶
0308
如何保证 Redis 和 MySQL 的数据一致性?
软件工程基础Redis 与缓存
方案设计
进阶
0313
如何识别并治理大模型幻觉?
AI 应用工程与治理生成质量与幻觉治理
故障排查
进阶

另有 1 篇多公司合集,可在面经记录中查看。