已筛选

3697 道题

排序:

0268
Self-Attention 为何利于并行训练,与 RNN 相比有哪些局限?
模型基础与推理Transformer 与注意力
比较选型
进阶
0269
Few-shot 为什么可能降低效果,示例应如何选择和排列?
AI 应用工程与治理Prompt 与结构化输出
方案设计
进阶
0270
调用外部工具的 Agent 如何建立可复现评测?
AI 应用工程与治理评测体系与实验设计
效果评估
深入
0271
Agent 如何抵御工具返回内容中的间接提示注入?
AI 应用工程与治理安全、权限与人工介入
方案设计
进阶
0273
SFT 与偏好数据如何构建,如何控制数据污染和分布偏移?
模型训练与对齐偏好对齐
方案设计
进阶
0274
Decoder-only 的 KV Cache 为什么缓存 K、V 而通常不缓存 Q?
模型基础与推理推理优化与模型压缩
原理机制
进阶
0275
如何从 KL 约束的强化学习目标推导 DPO 目标?
模型训练与对齐偏好对齐
原理机制
深入
0276
训练正常而离线评测骤降时,如何定位链路问题?
模型训练与对齐训练框架、调参与排障
故障排查
深入
0278
工业故障诊断项目如何排除测试污染与 Judge 偏差,证明训练策略收益?
模型训练与对齐Verifier 与训练评测
效果评估
深入
0279
MoE 负载均衡损失与专家路由塌缩有什么关系,如何稳定路由?
模型基础与推理模型架构与表示
故障排查
进阶