已筛选

3697 道题

排序:

3638
未来 Agent 基础能力中,模型、框架和 Skills 哪些需要重投入?
Agent 原理与系统Agent 框架与 Harness
开放讨论
3639
对话 LLM 与普通文本生成模型的核心区别是什么?
模型基础与推理模型架构与表示
比较选型
基础
3640
多轮对话训练时如何处理过长上下文?
模型训练与对齐预训练、续训与 SFT
方案设计
进阶
3641
Agentic Training 的完整流程是什么?
模型训练与对齐预训练、续训与 SFT
原理机制
进阶
3642
记忆系统中的意图识别承担什么职责?
Agent 原理与系统记忆系统
原理机制
基础
3643
如何确定 Embedding 维度,为什么选择 1024 维而非更高或更低?
RAG 与知识系统Embedding 与向量表示
比较选型
进阶
3644
原文所称 Qwen-4B Embedding 如何实现,是否属于 BERT 架构?
RAG 与知识系统Embedding 与向量表示
原理机制
进阶
3645
原文所称 Qwen-34B Rerank 如何实现?
RAG 与知识系统混合检索与重排序
原理机制
进阶
3646
Attention 的 Q、K、V 如何由输入变换得到?
模型基础与推理Transformer 与注意力
原理机制
基础
3647
Attention 为什么除以根号 d_k,不这样缩放还有什么替代方案?
模型基础与推理Transformer 与注意力
原理机制
进阶