当前位置: 首页 > news >正文

Agent开发简历面试点

⭐RAG项目

项目背景

• 帮助谁解决了什么问题?

• 为什么做这个项目?

• 系统的每天的使用量是多少?

项目要点

Rag基础

• 什么是Rag系统

• Rag系统的核心点是什么,主流程有哪些

• embedding模型用的什么,为什么要用这个模型

• Bert模型能不能用于embedding

• Rag是为了解决什么问题

• 你们为什么不用工具,要选择代码开发,coze和dify不能实现你们的需求吗,coze和dify的开发应该更快吧?

知识库

• 离线知识库的规模

• 用的什么向量数据库,为什么用这个

• 离线文档有哪些格式

• PDF中包含的图片怎么处理

• PDF中表格,尤其比较复杂的表格如何处理

• 你们用的什么框架解析文档的?为什么不用第3方集成好的工具

• 你们调研过哪些文档知识库的工具

• 文档分块怎么做的?为什么?父块1000是怎么定的

• 你们怎么评估知识库的分块,有没有把知识切开

• 你们如何做知识库的版本管理

• 你们怎么做知识的溯源的

检索

• 使用的什么embedding模型?为什么?你们还调研过哪些

• 混合检索是什么,你们怎么用的

• 假设检索是什么意思,能不能举个例子

• 子查询检索是什么,能不能举个例子说说

• 回溯检索是什么,对应场景是什么

• 你们用的reranker模型是什么,为什么选择这个

• 检索效果不好,可能是哪里出问题了,如何优化

• BM25是什么算法,与TF-IDF有什么区别

• 检索的效果如何评估的

意图识别

• 为什么要做意图识别

• 你们为什么选择用Bert模型,不直接用大模型做意图识别呢

• 你们具体怎么做的

• 如果意图分类错了,会怎么样,大模型回答效果如何,你们测试过吗

大模型

• 你们为什么用qwen2-7B的模型,不用更大的?

• 说说你对当前主流大模型包括闭源,模型之间的差异点有哪些?

• 微调

◦ 你们为什么要做微调,碰到什么问题了需要做微调

◦ 大模型微调以后的效果是如何评估的,你们用了哪些指标

◦ 你们用qwen2-7B,Lora微调的话显存占用多少,用的什么卡

◦ 你们微调用了多少显存,如果需要微调一个更大的模型,显存怎么评估

◦ 你们微调用了多少数据,训练了多少时间

◦ 大模型对于没有见过的知识,能不能用微调解决

◦ Lora微调的原理是什么,你们微调的哪些层

◦ LoRA与QLoRA有什么区别

• 大模型最终生成的效果不好,可能是哪里出问题了?

• 你们怎么评估最终的效果,有哪些指标,具体如何计算的?

• 什么是忠实度,什么是相关性,用什么方法计算的?

• 你们是如何部署大模型的?如果单张卡显存不够怎么办?


⭐技术栈

大模型应用的技术有哪些

• 提示词工程

• Rag检索增强

• 智能体

• 微调技术

什么是agent


什么是MCP,与function call有什么区别


上下文工程 Context Engineering 你了解吗


⭐Bert微调项目

项目背景

项目要点


⭐高频问答

RAG项目写多长时间?

分多个阶段:

  1. 从0到1开发阶段,使用低代码平台做效果验证。coze/dify只做了一个或者两个意图数,数据有限。开发周期1个月,需求讨论、数据收集、效果评测、满足哪些业务等方面。
  2. 迭代阶段:功能优化提升效果,增加意图数。链路复杂了,改用langchain框架,性能优化等,知识库效果评估。开发周期2-4个月
  3. 接入MCP、智能体阶段,模型微调,服务性能提升,使用云原生技术,资源实现弹性扩容。

开发周期2个月

只要说清楚当前的项目,经历个几个迭代版本。整体写个半年左右。

简历怎么写

写简历回答3个问题?

  1. 背景:用户的痛点问题是哪些?
  2. 项目要点,优化点:你如何解决这些问题?
  3. 项目成果:你解决了哪些问题,效果怎么样?

项目背景怎么写?

  • 首先找熟悉的行业和项目
  • 其次尽量找有价值的,企业能落地的背景
  • AI生成推荐项目背景,搞懂项目里面的业务,说白了自己编

比如:
外包公司和小公司基本不在意项目背景
中大型的公司自研,在意项目背景

期望薪资怎么说?

给出一个准确数字左右,尽量小的区间。

1年以及以下:15K
1-3年:18K
3-5年:22K
5年以上:28K

面试相关问题

  • RAG如何提升文档检索的精度?

    1. 使用效果更好的embedding模型
    2. 文档分块尽量保留独立的语义
    3. query改写
  • transformer中自注意力机制有什么用?
    长文本依赖问题,文本过长遗忘问题。

  • 系统的QPS写多少比较合适?物联网或者内部项目?
    QPS/QPM,根据项目背景决定,没有正确答案,合理就行
    合理:内部系统(500人x10query/人)/10小时 = 500query/h
    (大模型吞吐量 = 1000token/s 生成5000字就要5s,qps=0.2)

  • 模型选型,如何控制token成本?
    调研不同模型的,效果、吞吐量、token的成本。

  • coze和dify 如何集成到langchain项目中?
    coze和dify支持api调用

http://www.jsqmd.com/news/1309379/

相关文章:

  • RPG Maker解密工具终极指南:一键提取加密游戏资源
  • 网盘资源搜不到?爱搜神器帮你一键搞定 - 品牌观察室
  • NVIDIA Profile Inspector终极指南:3步解锁隐藏显卡性能的完整解决方案
  • 终极Docker镜像离线下载工具:零依赖跨平台部署完整指南
  • GoB插件:5分钟实现Blender与ZBrush无缝双向工作流
  • 游戏工作室常见误区:拿到版号前后,企业资质与财务数据必须保持一致
  • 【AI B端后台设计黄金法则】:20年架构师亲授5大避坑指南与落地 checklist
  • 如何用Tai追踪你的Windows时间:3步实现精准统计
  • 游戏开发者必看:3天速成AI音效工作流——Unity+AudioGPT无缝集成全教程
  • 完整指南:使用Docker部署pwned-search密码检查工具
  • STM32 启动流程解析:上电后第一条代码是如何执行的
  • 美术艺考培训机构如何摆脱平台高成本获客,BBWEYY GEO服务与小程序低成本转化实操指南,含零代码SAAS、AI编程、源码定制交付
  • Vin象棋:重新定义中国象棋AI辅助体验的智能解决方案
  • 为什么全国产短波红外相机这么少? - 米諾
  • 从0到量产:工业级SD面部修复节点Pipeline搭建(含FaceID校验模块+动态分辨率补偿算法)——某头部美颜SDK技术负责人首次披露
  • Spring中的八大设计模式详解
  • 多场景适用:multi-object-tracker在视频监控中的应用技巧
  • WAS Node Suite架构解析:ComfyUI中210+节点扩展的技术方案与实现原理
  • 暑期学习:自学Java第十七天
  • 仅剩87套未公开的AI连续图样Prompt库泄露:含纺织/包装/建材三大垂直领域专用参数矩阵(限时48小时领取)
  • appmsg接口采集公众号文章接口已谢幕
  • 海外短剧系统源码_多语言多支付TikTok Minis/H5出海下载搭建部署
  • 终极指南:5分钟掌握文言文加密神器Abracadabra魔曰
  • 2026年8月MBTI测试哪个准?从题库到报告拆解8个平台的选择逻辑 - 米諾
  • Maven与Gradle集成Spring Boot Thin Launcher:完整配置示例
  • 武汉管道疏通上门怎么选?本地疏通靠谱团队TOP5 全方位分析 - 园子一号
  • HarmonyOS NEXT 企业级记账APP:Canvas 绘制柱状图
  • MMRecord缓存机制详解:Core Data持久化与网络请求缓存策略
  • 科研绘图与数据可视化:做出专业级图表的方法与工具
  • CreBee是什么?一款面向个人、团队与企业的新媒体矩阵运营管理平台