已筛选

3697 道题

排序:

0098
压力较大时,你如何调整并继续推进工作?
项目与综合面试项目难点、复盘与改进
行为面
0100
项目中的强化学习框架是如何搭建的?
模型训练与对齐训练框架、调参与排障
项目深挖
深入
0103
强化学习包含哪些主要组件?
模型训练与对齐强化学习与奖励
概念解释
基础
0149
接口自动化测试如何实现,采用哪些工具?
软件工程基础测试工程与质量保障
项目深挖
进阶
0164
朋友、同学或家人会如何评价你?
项目与综合面试能力成长与学习方法
行为面
0165
大学和实验室经历中,你承担了什么工作,如何与导师协作?
项目与综合面试个人介绍与教育经历
经历介绍
0167
工程能力对 Agent 开发有什么影响?
项目与综合面试技术决策与业务理解
开放讨论
0169
RLHF/PPO 中 Actor、Critic、Reward Model 和 Reference Model 的职责是什么,为什么需要 KL 约束?
模型训练与对齐强化学习与奖励
原理机制
进阶
0178
多个 Agent 结论不一致或冲突时如何处理?
Agent 原理与系统多 Agent 编排与协作
故障排查
进阶
0183
项目中的文档清洗具体做了哪些工作?
RAG 与知识系统文档解析与清洗
项目深挖
进阶