已筛选

3697 道题

排序:

0084
蒸馏受限时,如何选择后训练方法提升模型能力?
模型训练与对齐蒸馏与模型合并
方案设计
进阶
0085
当 pass@k 与 pass@1 的差距收敛后,如何继续提升模型能力?
模型训练与对齐预训练、续训与 SFT
方案设计
深入
0087
协作办公方向的 Agent 还有哪些能力可以提升?
Agent 原理与系统Agent 应用架构与场景设计
方案设计
深入
0088
如何用知识图谱合成 Agent 任务?
模型训练与对齐训练数据构建与治理
方案设计
进阶
0090
除了训练数据,项目中还做了哪些算法改进?
模型训练与对齐训练数据构建与治理
项目深挖
深入
0094
有没有跳出原有做法、提出新方案并推进实施的经历?
项目与综合面试项目背景、架构与职责
行为面
0101
verl 中的 Agent Loop 如何实现?
模型训练与对齐训练框架、调参与排障
原理机制
进阶
0105
On-policy 和 Off-policy 有什么区别?
模型训练与对齐强化学习与奖励
比较选型
进阶
0109
cgroup 在资源管理中起什么作用?
软件工程基础容器、云原生与工程交付
概念解释
基础
0115
Agent 长程任务提前停止时,如何定位和处理?
Agent 原理与系统Agent 基础与运行循环
故障排查
进阶