已筛选

3697 道题

排序:

1236
如何体现和评估策略鲁棒性?
模型训练与对齐强化学习与奖励
方案设计
进阶
1237
给定金额和硬币种类,计算组成金额的方案数。
算法与编程题动态规划、贪心与回溯
代码题
进阶
1241
实现线程安全的 LRU 缓存。
算法与编程题并发、文件与工程编码
代码题
进阶
1242
为什么用同一模型生成和评测答案,评估时发现了哪些问题?
AI 应用工程与治理评测体系与实验设计
比较选型
进阶
1243
DeepSeek V3 背后的模型架构是什么?
模型基础与推理模型架构与表示
原理机制
进阶
1245
梯度如何计算,计算中可能遇到哪些问题?
模型训练与对齐训练框架、调参与排障
原理机制
进阶
1246
如何让 AI 自主完成独立模块的开发和测试,交付可用产物?
Agent 原理与系统多 Agent 编排与协作
方案设计
进阶
1248
一个线程崩溃为什么可能导致整个进程不可用?
软件工程基础操作系统与 Linux
原理机制
进阶
1251
单核 CPU 能否并发运行多个线程?
软件工程基础操作系统与 Linux
原理机制
基础
1252
什么是 CPU 亲和性?
软件工程基础操作系统与 Linux
概念解释
基础