AI 评测工程师(内容安全方向)一面、二面、三面面经
完整信息
本篇目录
timeline:
2026.8.20(一面)-8.30(二面)-9.2(三面)-9.4(HR面)
补充:一面结束第二天早上十点约当天二面,因为个人原因推迟
面试经过:
一面(核心):
一、实习相关:
1.当前是否仍在实习,为什么离职?
2.对于什么场景进行评测?评测目标是什么?评测集怎么构建的?
3.怎么保证构建的评测集覆盖所有场景且可用?
4.人工怎么进行问题归因的,归因标准是什么?
5.评测过程中的case错误率是多少?回归验证结果如何
二、业务相关:
1.场景下有大量文档和案例,使用模型来自动化生成评测集时,怎么保证用到正确的信息?
2.文档和案例两类数据,你如何组织两类数据来生成测试case?
3.实习中为什么没有考虑自动化评测?
4.我现在需要对云端agent的输出做安全校验,你会怎么设计校验方案?
5.介绍组内工作,询问个人意向
三、面试评价
实习经历相关度高,构造和归因方法清楚。实习中数据构造的场景和组内场景不太一致
四、面试分析
核心在于相关度高,实习工作梳理清楚,对组内工作有一定了解。
二面:
一、实习相关
新增:
1.有了解过自动化评测的论文、项目吗?
2.如果让你来将实习场景下的问题归因环节改造为自动化流程,你会如何设计?
二、业务相关
无
三、面试评价
其他都可以。提升的话,尽量多了解一下最新技术,读读论文
四、面试分析
不清楚二面评价标准
三面:
新增:
有做过模型本地部署吗?
评价:像是走流程
本篇目录
- 01
当前是否仍在实习,为什么离职?
- 02
对于什么场景进行评测?评测目标是什么?评测集怎么构建的?
- 03
怎么保证构建的评测集覆盖所有场景且可用?
上一问 ↑ - 04
人工怎么进行问题归因的,归因标准是什么?
- 05
评测过程中的case错误率是多少?回归验证结果如何
- 06
场景下有大量文档和案例,使用模型来自动化生成评测集时,怎么保证用到正确的信息?
- 07
文档和案例两类数据,你如何组织两类数据来生成测试case?
上一问 ↑ - 08
实习中为什么没有考虑自动化评测?
- 09
我现在需要对云端agent的输出做安全校验,你会怎么设计校验方案?
- 10
介绍组内工作,询问个人意向
- 11
有了解过自动化评测的论文、项目吗?
- 12
如果让你来将实习场景下的问题归因环节改造为自动化流程,你会如何设计?
- 13
有做过模型本地部署吗?
