深信服 · 客服 Agent(接入企业微信)

大模型算法工程师(模型微调)面经

完整信息

12 条问法 · 13 道题

本篇目录
1️⃣ 拷打项目:简历上有一段包装minimind的项目,面试官主要问的这一个(因为其他两个项目和大模型关联不太大,但面试官也问了一些细节的问题) 数据集有多大?多少条数据 你认为在训练过程中比较重要的参数是哪些?答的学习率和lora的秩 训练模型的过程中,会看哪些指标来判断模型训练的效果? 样本对choose,rejected的构建,会不会出现模型结果比真实回答更好的情况? 2️⃣ 常规八股 deepseek-R1中的核心贡献 介绍GRPO,PPO,DPO的区别 同策略和异策略 3️⃣ 在校的经历 竞赛承担的角色,有没有后续的一些成果转化? 小论文投了吗 4️⃣ 实习情况 能实习多久,工作地点 5️⃣ 反问 问了面试官主要的工作内容,是对模型做微调还是优化提示词?说主要是对模型做微调,弄一个客服的agent接到企业微信里
本篇目录
  1. 01
    1️⃣ 拷打项目:简历上有一段包装minimind的项目,面试官主要问的这一个(因为其他两个项目和大模型关联不太大,但面试官也问了一些细节的问题)
  2. 02
  3. 03
  4. 04
  5. 05
  6. 06
  7. 07
  8. 08
  9. 09
  10. 10
  11. 11
  12. 12
    反问
    问了面试官主要的工作内容,是对模型做微调还是优化提示词?说主要是对模型做微调,弄一个客服的agent接到企业微信里

相关公司