跳到主要内容
面试之前,先来面栈
搜索
题库
/
AI 应用工程与治理
评测体系与实验设计
10
个专题 ·
567
道题
专题概览
题目列表
567
评测体系与实验设计
继续复习
→
待复习
0
问题类型
问题类型
比较选型
代码题
方案设计
概念解释
故障排查
经历介绍
开放讨论
系统设计
项目深挖
效果评估
原理机制
问题类型
技术难度
技术难度
基础
进阶
深入
技术难度
复习状态
复习状态
未标记
待复习
已掌握
复习状态
已筛选
清除筛选
共
127
道题
开始复习 →
排序:
排序
相关面经最多
题集收录最多
题号顺序
最新更新
题号
题目
技术难度
收录情况
复习状态
2120
用户直接在系统中向模型提问时,有哪些评测方式?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
用户直接在系统中向模型提问时,有哪些评测方式?的复习状态
未标记
待复习
已掌握
›
2165
开发过程中是否进行大量 Agent 自测?
AI 应用工程与治理
评测体系与实验设计
项目深挖
已有答案
面前必看
进阶
1
篇面经
开发过程中是否进行大量 Agent 自测?的复习状态
未标记
待复习
已掌握
›
2172
如何确认 RAG 产出是否存在幻觉?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
如何确认 RAG 产出是否存在幻觉?的复习状态
未标记
待复习
已掌握
›
2203
Agent 每次迭代后如何证明新版本优于旧版本?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
Agent 每次迭代后如何证明新版本优于旧版本?的复习状态
未标记
待复习
已掌握
›
2204
除了成功率和得分,如何评价 Token、工具与 Skill 使用、执行路径等过程指标?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
除了成功率和得分,如何评价 Token、工具与 Skill 使用、执行路径等过程指标?的复习状态
未标记
待复习
已掌握
›
2205
一万条 Case 的 Agent 执行路径由谁判断,如何规模化评估?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
深入
1
篇面经
一万条 Case 的 Agent 执行路径由谁判断,如何规模化评估?的复习状态
未标记
待复习
已掌握
›
2206
使用 Agent 或 LLM Judge 评测时,如何设计评测 Prompt?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
1
份题集
使用 Agent 或 LLM Judge 评测时,如何设计评测 Prompt?的复习状态
未标记
待复习
已掌握
›
2207
面对一万个不同 Case,评测 Prompt 如何通用化?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
深入
1
篇面经
面对一万个不同 Case,评测 Prompt 如何通用化?的复习状态
未标记
待复习
已掌握
›
2208
ToC 每天上万条任务时,如何自动发现执行问题而不对每条任务额外运行一次模型?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
深入
1
篇面经
ToC 每天上万条任务时,如何自动发现执行问题而不对每条任务额外运行一次模型?的复习状态
未标记
待复习
已掌握
›
2311
如何生成或组织 AI 测试报告?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
如何生成或组织 AI 测试报告?的复习状态
未标记
待复习
已掌握
›
2120
用户直接在系统中向模型提问时,有哪些评测方式?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
用户直接在系统中向模型提问时,有哪些评测方式?的复习状态
未标记
待复习
已掌握
›
未找到相关题目
换个关键词,或清除筛选。
清除筛选
共
127
道题 · 显示 81–90 道
上一页
1
…
8
9
10
…
13
9 / 13
下一页
启用 JavaScript 后可筛选和浏览完整题库;当前显示前 10 道题。