← 返回全部题目← 上一题30 / 37下一题 →题库/模型训练与对齐/Q-3484SFT 与 RL 数据中的 Reason 是人工标注还是模型生成?知识专题:训练数据构建与治理题目类型:项目深挖技术难度:进阶相关面经:1 篇暂无参考答案未标记未标记待复习已掌握收藏本题目录相关面经相关题目相关面经1 篇阿里巴巴Agent 算法工程师2026-05-16一面、二面查看原面经 →追问reason是由人标注还是模型生成?相关题目4 题0081如何合成 Agent 训练任务,并验证任务设计带来的增益?同一知识专题题目类型:方案设计技术难度:深入相关面经:3 篇0082Coding 方向训练数据如何扩规模,如何考虑外部采购?同一知识专题题目类型:方案设计技术难度:深入相关面经:1 篇0088如何用知识图谱合成 Agent 任务?同一知识专题题目类型:方案设计技术难度:进阶相关面经:1 篇0089训练数据如何合成与筛选?同一知识专题题目类型:项目深挖技术难度:进阶相关面经:3 篇← 上一题已到最后一题← 上一题如何设计困难样本挖掘,使项目中的 8B 模型效果超过 14B 模型?下一题 →微调如何权衡数据多样性、长尾采样和 Prompt 设计?