已筛选

3697 道题

排序:

2899
DPO 训练有哪些需要注意的事项?
模型训练与对齐偏好对齐
方案设计
进阶
2900
Agent 如何分别评估规划能力与幻觉率?
AI 应用工程与治理评测体系与实验设计
效果评估
进阶
2901
微调 Qwen 时如何选择训练阶段和损失函数?
模型训练与对齐参数高效微调
方案设计
进阶
2902
Prompt 自动推荐如何优化,压缩与 Embedding 表示是否有帮助?
AI 应用工程与治理Prompt 与结构化输出
方案设计
进阶
2904
LoRA 训练后推理是否必须挂载 Adapter?
模型训练与对齐参数高效微调
原理机制
进阶
2905
如何区分视觉编码器与 LLM 推理瓶颈,并避免 Caption 替代实验泄露答案?
AI 应用工程与治理评测体系与实验设计
方案设计
深入
2906
如何量化回答不确定性,Top-K Token 分差与长文本哪些部分参与计算?
AI 应用工程与治理评测体系与实验设计
效果评估
深入
2907
多 Agent 辩论迭代机制如何设计?
Agent 原理与系统多 Agent 编排与协作
方案设计
进阶
2908
为什么选用三个维度设计推理能力评测题?
AI 应用工程与治理评测体系与实验设计
方案设计
进阶
2909
如何提高模型挖掘关联关系并正确回答的能力?
模型基础与推理模型选型与能力边界
方案设计
进阶