阿里巴巴

74 篇面经595 道面试题

已筛选

595 道题

排序:

3544
如何量化评估整体对话效果?
AI 应用工程与治理评测体系与实验设计
效果评估
进阶
3545
Agent 对齐优化为什么选择强化学习,如何与 SFT、DPO、PPO、GRPO 和 RAG 比较?
模型训练与对齐强化学习与奖励
比较选型
进阶
3546
如何评估 DPO 全流程效果,并结合业务分析其短板?
AI 应用工程与治理评测体系与实验设计
效果评估
进阶
3547
DPO 与 GRPO 的原理、优缺点和适用场景有何差异?
模型训练与对齐强化学习与奖励
比较选型
进阶
3548
如何从算法机制解释 GRPO 的探索能力和训练稳定性?
模型训练与对齐强化学习与奖励
原理机制
进阶
3549
语义、固定长度与递归切分如何比较,为什么选择递归切分?
RAG 与知识系统文档切分与元数据
比较选型
进阶
3550
线上高并发、低延迟场景下如何选择向量数据库?
RAG 与知识系统向量数据库与索引
比较选型
进阶
3551
用户意图模糊、指代不清时,如何识别和澄清需求?
Agent 原理与系统规划、推理与任务执行
方案设计
进阶
3560
把两个无序链表合并为一个有序链表。
算法与编程题链表、栈与队列
代码题
进阶
3561
建立连接时有哪些常用超时,各起什么作用?
软件工程基础网络与浏览器
原理机制
基础