大模型应用开发工程师(RAG 方向)一面面经
完整信息
本篇目录
钉钉一面
流程:自我介绍 → 学习方向与背景 → 实习深挖(提示词自动调优 + RAG + 多 Agent + 评测) → 代码测试 → 反问。
面试官问题
一、学习方向与背景
您先做个自我介绍。
提到这个新的技术专业方向,您最近在学的一个技术是哪方面?
你理解 MCP 相比于之前没有 MCP 的时代,解决了什么问题?
在学校期间哪一门课程是你最感兴趣的?
二、实习深挖(提示词自动调优)
你在实习公司做的发布平台,算是大 Agent 是吧?(追问)你觉得这里面最大的挑战点是什么?
可以先说一下这个自动调优的核心思想吗?
评价的模型用的是什么?
这个自动调优,这个项目是你自己写的吗,还是基于什么框架去完成的?
那你这个自动调优脚本,是直接调的那个大模型的接口吗,还是说也是基于框架?
调优脚本是什么语言写的?
这个调优是全部都是你自己开发的吗?
三、RAG
介绍一下什么是 RAG?
知识库内容的分块是怎么做的?
你刚才提到一个全文检索效率低,为什么是效率低呢?
刚才提到那个幻觉,幻觉你怎么解决的?
有一些其他办法可以缓解这种模型幻觉吗?
你们用的向量库是哪个?Embedding 的模型是?
那你们向量库为什么会选择这个呢?有考虑其他的吗?
这个 RAG 的质量是有评估吗?
RAG 那边你是直接调别人的服务是吗?
四、QA 提取与评测
从值班聊天记录中提取 QA,聊天记录里面的 QA 是怎么识别的?
有些聊天记录里面,你们怎么去过滤无效的聊天记录呢?
你这个 17% 的提升,这个是怎么测出来的?
你们这个统计大概包含历史有多少条值班记录?
刚才提到你们是别人来咨询的时候去问模型,那模型不是不会直接回答吗?中间要经过你们一道人工的……
如果是系统上直接有用户去问大模型的话,这种有什么评测的方式吗?
五、多 Agent 架构
你把单 Agent 改造成多 Agent,这两个的区别主要在哪个方面,为什么单个 Agent 不太行而多个就可以?
六、代码测试
我们来做个简单的代码测试,邮箱里应该能收到一个链接,可以先说一下大概思路。
(追问)给你的实现复杂度是?
(追问)可以写一下。
(追问)那么这个结尾减一,如果这个结尾加一这个值不存在呢?
反问
可以麻烦简单介绍一下您所在部门或者小组具体负责的业务吗?(面试官回答)钉钉 AI 营销服部门,业务场景是钉钉作为一个 2B 应用,做线下零售门店的 AI 解决方案(如卖家具、卖车等零售门店)。基于门店音视频数据做 GenAI 分析,提供给企业经营者和上层管理者,用于优化企业管理。例如智能工牌硬件,销售与客户沟通的录音可被分析(是否按规定动作介绍、客户需求、客户满意度等),把数据现线化以支撑后续业务。
您所在小组相当于是专门负责 AI 这一块业务的吗?(面试官回答)以前做音效副主要是 CRM,今天这块业务完全是基于 AI 在重构业务逻辑。
用到的具体技术栈大概是什么?是用 Java 还是 Python?(面试官回答)模型调用层有 Java、Python、Go;框架上有内部类似 Dify 的 Deep 平台(钉钉 AI 部门内部用来做 Agent 相关开发的基础平台),也有项目在用类似 Spring AI 的方案。
面试反馈大概多久会有反馈?(面试官回答)一般一周左右。
整体面试流程顺利的话大概有几轮?(面试官回答)不太确定,看具体情况。
阿里校招内推码:2T4VR26T
本篇目录
- 01
您先做个自我介绍。
- 02
您最近在学的一个技术是哪方面?
- 03
你理解 MCP 相比于之前没有 MCP 的时代,解决了什么问题?
- 04
在学校期间哪一门课程是你最感兴趣的?
- 05
你在实习公司做的发布平台,算是大 Agent 是吧?
- 06
你觉得这里面最大的挑战点是什么?
上一问 ↑ - 07
可以先说一下这个自动调优的核心思想吗?
- 08
评价的模型用的是什么?
上一问 ↑ - 09
这个自动调优,这个项目是你自己写的吗,还是基于什么框架去完成的?
上一问 ↑ - 10
那你这个自动调优脚本,是直接调的那个大模型的接口吗,还是说也是基于框架? > 调优脚本是什么语言写的?
上一问 ↑ - 11
这个调优是全部都是你自己开发的吗?
上一问 ↑ - 12
介绍一下什么是 RAG?
- 13
知识库内容的分块是怎么做的?
- 14
你刚才提到一个全文检索效率低,为什么是效率低呢?
- 15
刚才提到那个幻觉,幻觉你怎么解决的? > 有一些其他办法可以缓解这种模型幻觉吗?
- 16
Embedding 的模型是?
- 17
你们用的向量库是哪个?
- 18
那你们向量库为什么会选择这个呢?有考虑其他的吗?
- 19
这个 RAG 的质量是有评估吗?
- 20
RAG 那边你是直接调别人的服务是吗?
- 21
从值班聊天记录中提取 QA,聊天记录里面的 QA 是怎么识别的?
- 22
有些聊天记录里面,你们怎么去过滤无效的聊天记录呢?
上一问 ↑ - 23
你这个 17% 的提升,这个是怎么测出来的? > 你们这个统计大概包含历史有多少条值班记录?
上一问 ↑ - 24
刚才提到你们是别人来咨询的时候去问模型,那模型不是不会直接回答吗?中间要经过你们一道人工的……
- 25
如果是系统上直接有用户去问大模型的话,这种有什么评测的方式吗?
上一问 ↑ - 26
你把单 Agent 改造成多 Agent,这两个的区别主要在哪个方面,为什么单个 Agent 不太行而多个就可以?
- 27
可以麻烦简单介绍一下您所在部门或者小组具体负责的业务吗?
- 28
您所在小组相当于是专门负责 AI 这一块业务的吗?
- 29
用到的具体技术栈大概是什么?是用 Java 还是 Python?
- 30
面试反馈大概多久会有反馈?
- 31
整体面试流程顺利的话大概有几轮?
