已筛选

3697 道题

排序:

0608
组内样本全对或全错有什么问题,DAPO 如何处理?
模型训练与对齐训练数据构建与治理
原理机制
进阶
0609
Reward Model 常用什么结构,与 Value Model 有什么区别?
模型训练与对齐强化学习与奖励
比较选型
进阶
0611
为什么选择 vLLM,与其他推理方案相比如何?
AI 应用工程与治理模型服务、部署与交付
比较选型
进阶
0613
大模型的输入与输出如何表示?
模型基础与推理模型架构与表示
原理机制
基础
0614
SFT 和 PEFT 训练中使用过哪些技巧?
模型训练与对齐参数高效微调
项目深挖
进阶
0616
如何解决模型像复读机一样重复生成的问题?
模型基础与推理推理优化与模型压缩
故障排查
进阶
0617
求两个序列的最长公共子序列。
算法与编程题动态规划、贪心与回溯
代码题
进阶
0618
跨境汇款 Agent 超时或失败时,如何保证资金安全?
AI 应用工程与治理安全、权限与人工介入
方案设计
深入
0620
求岛屿的最大面积。
算法与编程题树、图与遍历
代码题
基础
0621
MySQL 主键为什么通常推荐自增?
软件工程基础数据库与 SQL
原理机制
进阶