Agent 应用开发工程师一面面经
完整信息
本篇目录
前面对于项目和实习的拷打,偶尔穿插八股,后面考察基础。
0.自我介绍
1. 先说一下这个 Agent 项目;它是做代码问答的吗?
2. 如果拿一段线上报错日志,它能分析 bug、指出代码哪里有问题吗?
3. 项目里的 LLM Runtime、Tool Runtime 分别负责什么?
4. 模型路由的依据是什么?
5. 错误重试是所有错误都会重试吗?参数错误怎么处理?
6. 有流式输出吗?具体的流式响应是怎么处理的?
7. SSE 和普通 HTTP 连接有什么区别?
8. SSE 和 WebSocket 有什么区别?WebSocket 是半双工吗?
9. 如果设计了多轮工具调用,上下文是怎么管理的?
10. 工具的返回结果会很大吗?实际遇到过吗?
11. 上下文截断除了丢失信息,还有什么问题?实际遇到过什么问题?
12. 工具有超时吗?工具是并发调用的吗?
13. 幂等性具体怎么保证?
14. Trace 的 Hook 是怎么设计的,分为哪几层?
15. 用户的一次请求在最终的 Trace 展示上是什么形式?Trace 具体怎么用,会做分析吗?
16. 有没有通过 Trace 分析过中间某个节点出问题的情况?
17. Memory 是怎么设计的?
18. 不同用户之间是怎么隔离的?
19. Checkpoint 保存了哪些内容?
20. 为什么设计主子 Agent?
21. 你的项目都是关于 Agent 的吗?
22. 第二段实习是去年的吗?
23. 下面这个项目是你的毕业课题吗?(刚大四,不是)
24. 说一下 RAG 的原理,以及为什么要用 RAG。
25. RAG 的流程是什么?
26. 项目的原始语料是什么,是 PDF 吗?PDF 是怎么解析的?
27. 为了保证连续语义,文本具体怎么切分?有什么算法?
28. 表格为什么要转成 HTML?有什么好处?
29. Chunk 太大或太小有什么影响?Chunk 大小怎么确定?
30. 为什么选择混合召回?
31. BM25 和向量检索分别解决什么类型的问题?
32. 有没有通过实验分析向量检索及混合检索带来的提升?
33. RRF 具体是什么算法?
34. 为什么不直接加权?
35. RRF 中的常数是怎么确定的?
36. 评测集是怎么做的?
37. 业务实体、时间等信息是在召回前还是召回后提取?
38. 如果问某上市公司去年毛利率下降,Agent 收到 Prompt 后的完整流程是什么?
39. 有什么办法验证 Agent 的结论是否正确?
40. 结论会有引用吗?引用是怎么在结论中体现和实现的?
41. 计算机基础课程掌握得怎么样?
42. 了解 MySQL 的存储引擎和 InnoDB 吗?
43. InnoDB 默认是什么隔离级别?隔离级别的实现方式是什么?
44. MVCC 是怎么实现的?
45. 除了 MVCC,还有什么机制可以避免幻读?
46. binlog、undo log 和 redo log 分别有什么作用?
47. 聚簇索引和非聚簇索引有什么区别?
48. 计算机网络、操作系统等课程学过吗?
49. 什么是子网?
50. 子网和 VLAN 了解吗?
51.手撕找到数组中top-k元素。
手撕一开始说堆排,问有没有更好的办法,后面提示可以用快排来做,时间复杂度会降到On
面试态度评价:这是秋招第一面,面试官很好,能看得出来百度的面试官很强,一直在引导,态度也很好,只是后面基础部分本人回答的实在有点不争气
本篇目录
- 01
自我介绍
- 02
先说一下这个 Agent 项目;它是做代码问答的吗?
- 03
如果拿一段线上报错日志,它能分析 bug、指出代码哪里有问题吗?
- 04
项目里的 LLM Runtime、Tool Runtime 分别负责什么?
- 05
模型路由的依据是什么?
- 06
错误重试是所有错误都会重试吗?参数错误怎么处理?
- 07
有流式输出吗?具体的流式响应是怎么处理的?
- 08
SSE 和普通 HTTP 连接有什么区别?
- 09
SSE 和 WebSocket 有什么区别?WebSocket 是半双工吗?
- 10
如果设计了多轮工具调用,上下文是怎么管理的?
- 11
工具的返回结果会很大吗?实际遇到过吗?
- 12
上下文截断除了丢失信息,还有什么问题?实际遇到过什么问题?
- 13
工具有超时吗?工具是并发调用的吗?
- 14
幂等性具体怎么保证?
- 15
Trace 的 Hook 是怎么设计的,分为哪几层?
- 16
用户的一次请求在最终的 Trace 展示上是什么形式?Trace 具体怎么用,会做分析吗?
- 17
有没有通过 Trace 分析过中间某个节点出问题的情况?
- 18
Memory 是怎么设计的?
- 19
不同用户之间是怎么隔离的?
- 20
Checkpoint 保存了哪些内容?
- 21
为什么设计主子 Agent?
- 22
你的项目都是关于 Agent 的吗?
- 23
第二段实习是去年的吗?
- 24
下面这个项目是你的毕业课题吗?(刚大四,不是)
- 25
说一下 RAG 的原理,以及为什么要用 RAG。
- 26
RAG 的流程是什么?
- 27
项目的原始语料是什么,是 PDF 吗?PDF 是怎么解析的?
- 28
为了保证连续语义,文本具体怎么切分?有什么算法?
- 29
表格为什么要转成 HTML?有什么好处?
- 30
Chunk 太大或太小有什么影响?Chunk 大小怎么确定?
- 31
为什么选择混合召回?
- 32
BM25 和向量检索分别解决什么类型的问题?
- 33
有没有通过实验分析向量检索及混合检索带来的提升?
- 34
RRF 具体是什么算法?
- 35
为什么不直接加权?
上一问 ↑ - 36
RRF 中的常数是怎么确定的?
上一问 ↑ - 37
评测集是怎么做的?
- 38
业务实体、时间等信息是在召回前还是召回后提取?
- 39
如果问某上市公司去年毛利率下降,Agent 收到 Prompt 后的完整流程是什么?
- 40
有什么办法验证 Agent 的结论是否正确?
- 41
结论会有引用吗?引用是怎么在结论中体现和实现的?
- 42
了解 MySQL 的存储引擎和 InnoDB 吗?
- 43
InnoDB 默认是什么隔离级别?隔离级别的实现方式是什么?
- 44
MVCC 是怎么实现的?
- 45
除了 MVCC,还有什么机制可以避免幻读?
- 46
binlog、undo log 和 redo log 分别有什么作用?
- 47
聚簇索引和非聚簇索引有什么区别?
- 48
什么是子网?
- 49
子网和 VLAN 了解吗?
- 50
手撕找到数组中top-k元素。
- 51
手撕一开始说堆排,问有没有更好的办法