已筛选

3697 道题

排序:

3048
逻辑推理微调的 LoRA 秩 r 是否需要高于对话生成任务?
模型训练与对齐参数高效微调
比较选型
进阶
3049
垂直领域微调后通用能力衰减,如何优化?
模型训练与对齐训练框架、调参与排障
故障排查
进阶
3050
RAG 相比传统检索加生成流水线的优势是什么?
RAG 与知识系统RAG 架构与生成链路
比较选型
进阶
3051
DPO 为什么不需要在线采样,训练数据采用什么格式?
模型训练与对齐偏好对齐
原理机制
进阶
3052
GRPO 中 KL 散度损失如何计算实现?
模型训练与对齐强化学习与奖励
原理机制
深入
3054
用户需求模糊时应先反问澄清,还是直接检索回答?
Agent 原理与系统规划、推理与任务执行
比较选型
基础
3055
call、apply 和 bind 有什么区别?
软件工程基础前端与 Web
比较选型
基础
3056
箭头函数和普通函数有什么区别?
软件工程基础前端与 Web
比较选型
基础
3057
组件里的 setTimeout 尚未执行就卸载组件,会发生什么?
软件工程基础前端与 Web
原理机制
基础
3058
如何理解主流 Agent 不常使用 RAG 这一说法?
Agent 原理与系统Agent 框架与 Harness
开放讨论