已筛选

3697 道题

排序:

3358
日常 AI 编程的 Token 消耗量是多少?
AI 应用工程与治理性能、时延与成本
经历介绍
3360
MCP 与 Skill 分别会产生怎样的 Token 消耗?
Agent 原理与系统Skills 能力系统
比较选型
进阶
3361
是否实际开发过 MCP、Skill 或 A2A 工具?
Agent 原理与系统MCP、A2A 与工具协议
经历介绍
3362
实现二叉树的右视图。
算法与编程题树、图与遍历
代码题
基础
3363
项目奖励函数后续有什么改进思路?
模型训练与对齐强化学习与奖励
项目深挖
进阶
3364
KL 散度有什么作用,为什么使用它?
模型训练与对齐强化学习与奖励
原理机制
进阶
3366
使用双指针实现链表相加。
算法与编程题链表、栈与队列
代码题
基础
3367
了解哪些 GRPO 改进算法?
模型训练与对齐强化学习与奖励
概念解释
进阶
3368
较长对话的强化学习奖励如何设计?
模型训练与对齐强化学习与奖励
方案设计
进阶
3369
奖励什么时候使用模型,什么时候使用规则?
模型训练与对齐强化学习与奖励
比较选型
进阶