已筛选

3697 道题

排序:

0513
预训练、后训练到推理的流程是什么?
模型训练与对齐预训练、续训与 SFT
原理机制
基础
0516
模型如何实现超长上下文能力?
模型基础与推理推理优化与模型压缩
原理机制
进阶
0517
如何训练模型,使其更精确地提取摘要?
模型训练与对齐预训练、续训与 SFT
方案设计
进阶
0519
买卖股票的最佳时机 III(最多两次交易)。
算法与编程题动态规划、贪心与回溯
代码题
进阶
0520
买卖股票的最佳时机 IV(最多 k 次交易)。
算法与编程题动态规划、贪心与回溯
代码题
进阶
0521
轨迹训练数据的规模、字段格式和生成方式是什么?
模型训练与对齐训练数据构建与治理
项目深挖
进阶
0522
轨迹模型采用什么动作空间?
模型基础与推理多模态与生成模型
原理机制
进阶
0523
线上长轨迹采集有哪些难点,VM 和沙盒环境如何同步?
模型训练与对齐训练数据构建与治理
方案设计
深入
0525
线上运行的轨迹模型如何判断任务已经完成?
Agent 原理与系统Agent 基础与运行循环
效果评估
进阶
0526
轨迹模型训练使用多少计算资源?
模型训练与对齐分布式训练与计算硬件
项目深挖
进阶