Agent开发简历面试点
⭐RAG项目
项目背景
• 帮助谁解决了什么问题?
• 为什么做这个项目?
• 系统的每天的使用量是多少?
项目要点
Rag基础
• 什么是Rag系统
• Rag系统的核心点是什么,主流程有哪些
• embedding模型用的什么,为什么要用这个模型
• Bert模型能不能用于embedding
• Rag是为了解决什么问题
• 你们为什么不用工具,要选择代码开发,coze和dify不能实现你们的需求吗,coze和dify的开发应该更快吧?
知识库
• 离线知识库的规模
• 用的什么向量数据库,为什么用这个
• 离线文档有哪些格式
• PDF中包含的图片怎么处理
• PDF中表格,尤其比较复杂的表格如何处理
• 你们用的什么框架解析文档的?为什么不用第3方集成好的工具
• 你们调研过哪些文档知识库的工具
• 文档分块怎么做的?为什么?父块1000是怎么定的
• 你们怎么评估知识库的分块,有没有把知识切开
• 你们如何做知识库的版本管理
• 你们怎么做知识的溯源的
检索
• 使用的什么embedding模型?为什么?你们还调研过哪些
• 混合检索是什么,你们怎么用的
• 假设检索是什么意思,能不能举个例子
• 子查询检索是什么,能不能举个例子说说
• 回溯检索是什么,对应场景是什么
• 你们用的reranker模型是什么,为什么选择这个
• 检索效果不好,可能是哪里出问题了,如何优化
• BM25是什么算法,与TF-IDF有什么区别
• 检索的效果如何评估的
意图识别
• 为什么要做意图识别
• 你们为什么选择用Bert模型,不直接用大模型做意图识别呢
• 你们具体怎么做的
• 如果意图分类错了,会怎么样,大模型回答效果如何,你们测试过吗
大模型
• 你们为什么用qwen2-7B的模型,不用更大的?
• 说说你对当前主流大模型包括闭源,模型之间的差异点有哪些?
• 微调
◦ 你们为什么要做微调,碰到什么问题了需要做微调
◦ 大模型微调以后的效果是如何评估的,你们用了哪些指标
◦ 你们用qwen2-7B,Lora微调的话显存占用多少,用的什么卡
◦ 你们微调用了多少显存,如果需要微调一个更大的模型,显存怎么评估
◦ 你们微调用了多少数据,训练了多少时间
◦ 大模型对于没有见过的知识,能不能用微调解决
◦ Lora微调的原理是什么,你们微调的哪些层
◦ LoRA与QLoRA有什么区别
• 大模型最终生成的效果不好,可能是哪里出问题了?
• 你们怎么评估最终的效果,有哪些指标,具体如何计算的?
• 什么是忠实度,什么是相关性,用什么方法计算的?
• 你们是如何部署大模型的?如果单张卡显存不够怎么办?
⭐技术栈
大模型应用的技术有哪些
• 提示词工程
• Rag检索增强
• 智能体
• 微调技术
什么是agent
什么是MCP,与function call有什么区别
上下文工程 Context Engineering 你了解吗
⭐Bert微调项目
项目背景
项目要点
⭐高频问答
RAG项目写多长时间?
分多个阶段:
- 从0到1开发阶段,使用低代码平台做效果验证。coze/dify只做了一个或者两个意图数,数据有限。开发周期1个月,需求讨论、数据收集、效果评测、满足哪些业务等方面。
- 迭代阶段:功能优化提升效果,增加意图数。链路复杂了,改用langchain框架,性能优化等,知识库效果评估。开发周期2-4个月
- 接入MCP、智能体阶段,模型微调,服务性能提升,使用云原生技术,资源实现弹性扩容。
开发周期2个月
只要说清楚当前的项目,经历个几个迭代版本。整体写个半年左右。
简历怎么写
写简历回答3个问题?
- 背景:用户的痛点问题是哪些?
- 项目要点,优化点:你如何解决这些问题?
- 项目成果:你解决了哪些问题,效果怎么样?
项目背景怎么写?
- 首先找熟悉的行业和项目
- 其次尽量找有价值的,企业能落地的背景
- AI生成推荐项目背景,搞懂项目里面的业务,说白了自己编
比如:
外包公司和小公司基本不在意项目背景
中大型的公司自研,在意项目背景
期望薪资怎么说?
给出一个准确数字左右,尽量小的区间。
1年以及以下:15K
1-3年:18K
3-5年:22K
5年以上:28K
面试相关问题
RAG如何提升文档检索的精度?
- 使用效果更好的embedding模型
- 文档分块尽量保留独立的语义
- query改写
transformer中自注意力机制有什么用?
长文本依赖问题,文本过长遗忘问题。系统的QPS写多少比较合适?物联网或者内部项目?
QPS/QPM,根据项目背景决定,没有正确答案,合理就行
合理:内部系统(500人x10query/人)/10小时 = 500query/h
(大模型吞吐量 = 1000token/s 生成5000字就要5s,qps=0.2)模型选型,如何控制token成本?
调研不同模型的,效果、吞吐量、token的成本。coze和dify 如何集成到langchain项目中?
coze和dify支持api调用
