跳到主要内容
面试之前,先来面栈
搜索
题库
/
AI 应用工程与治理
评测体系与实验设计
10
个专题 ·
567
道题
专题概览
题目列表
567
评测体系与实验设计
继续复习
→
待复习
0
问题类型
问题类型
比较选型
代码题
方案设计
概念解释
故障排查
经历介绍
开放讨论
系统设计
项目深挖
效果评估
原理机制
问题类型
技术难度
技术难度
基础
进阶
深入
技术难度
复习状态
复习状态
未标记
待复习
已掌握
复习状态
已筛选
清除筛选
共
127
道题
开始复习 →
排序:
排序
相关面经最多
题集收录最多
题号顺序
最新更新
题号
题目
技术难度
收录情况
复习状态
2603
测试 Agent 时可以在哪些环节用 AI 提效,需要设计或接入哪些工具?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
测试 Agent 时可以在哪些环节用 AI 提效,需要设计或接入哪些工具?的复习状态
未标记
待复习
已掌握
›
2900
Agent 如何分别评估规划能力与幻觉率?
AI 应用工程与治理
评测体系与实验设计
效果评估
已有答案
面前必看
进阶
暂无面经
Agent 如何分别评估规划能力与幻觉率?的复习状态
未标记
待复习
已掌握
›
2905
如何区分视觉编码器与 LLM 推理瓶颈,并避免 Caption 替代实验泄露答案?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
深入
暂无面经
如何区分视觉编码器与 LLM 推理瓶颈,并避免 Caption 替代实验泄露答案?的复习状态
未标记
待复习
已掌握
›
2906
如何量化回答不确定性,Top-K Token 分差与长文本哪些部分参与计算?
AI 应用工程与治理
评测体系与实验设计
效果评估
已有答案
面前必看
深入
暂无面经
如何量化回答不确定性,Top-K Token 分差与长文本哪些部分参与计算?的复习状态
未标记
待复习
已掌握
›
2908
为什么选用三个维度设计推理能力评测题?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
暂无面经
为什么选用三个维度设计推理能力评测题?的复习状态
未标记
待复习
已掌握
›
2942
如何验证新 AI 改善游戏体验,而非单纯增加难度?
AI 应用工程与治理
评测体系与实验设计
效果评估
已有答案
面前必看
进阶
暂无面经
如何验证新 AI 改善游戏体验,而非单纯增加难度?的复习状态
未标记
待复习
已掌握
›
2979
如何评估语义或意图识别的准确率?
AI 应用工程与治理
评测体系与实验设计
效果评估
已有答案
面前必看
进阶
暂无面经
如何评估语义或意图识别的准确率?的复习状态
未标记
待复习
已掌握
›
3012
Code Agent 的 Verifier 如何设计?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
暂无面经
Code Agent 的 Verifier 如何设计?的复习状态
未标记
待复习
已掌握
›
3028
同时运行多实验且各有多个分组时,如何分配用户并保证实验互不影响?
AI 应用工程与治理
评测体系与实验设计
系统设计
已有答案
面前必看
深入
暂无面经
同时运行多实验且各有多个分组时,如何分配用户并保证实验互不影响?的复习状态
未标记
待复习
已掌握
›
3072
33% 缓存命中率是总体还是单层,如何测得?
AI 应用工程与治理
评测体系与实验设计
项目深挖
已有答案
面前必看
进阶
暂无面经
33% 缓存命中率是总体还是单层,如何测得?的复习状态
未标记
待复习
已掌握
›
2603
测试 Agent 时可以在哪些环节用 AI 提效,需要设计或接入哪些工具?
AI 应用工程与治理
评测体系与实验设计
方案设计
已有答案
面前必看
进阶
1
篇面经
测试 Agent 时可以在哪些环节用 AI 提效,需要设计或接入哪些工具?的复习状态
未标记
待复习
已掌握
›
未找到相关题目
换个关键词,或清除筛选。
清除筛选
共
127
道题 · 显示 101–110 道
上一页
1
…
9
10
11
12
13
11 / 13
下一页
启用 JavaScript 后可筛选和浏览完整题库;当前显示前 10 道题。