已筛选

3697 道题

排序:

3546
如何评估 DPO 全流程效果,并结合业务分析其短板?
AI 应用工程与治理评测体系与实验设计
效果评估
进阶
3547
DPO 与 GRPO 的原理、优缺点和适用场景有何差异?
模型训练与对齐强化学习与奖励
比较选型
进阶
3548
如何从算法机制解释 GRPO 的探索能力和训练稳定性?
模型训练与对齐强化学习与奖励
原理机制
进阶
3549
语义、固定长度与递归切分如何比较,为什么选择递归切分?
RAG 与知识系统文档切分与元数据
比较选型
进阶
3550
线上高并发、低延迟场景下如何选择向量数据库?
RAG 与知识系统向量数据库与索引
比较选型
进阶
3551
用户意图模糊、指代不清时,如何识别和澄清需求?
Agent 原理与系统规划、推理与任务执行
方案设计
进阶
3552
智能运维助手中的“运维”具体指什么?
Agent 原理与系统Agent 应用架构与场景设计
项目深挖
进阶
3553
Spring AI Alibaba 覆盖项目的哪些模块?
Agent 原理与系统Agent 框架与 Harness
项目深挖
进阶
3554
Planner、Executor、Supervisor 三角色相比单 Agent 有哪些优势?
Agent 原理与系统多 Agent 编排与协作
比较选型
进阶
3555
回答效果不佳时,如何分别通过 RAG 和微调改进?
模型训练与对齐训练框架、调参与排障
方案设计
进阶