当前位置: 首页 > news >正文

Stage 0: Understand What An Agent Is - Charlie

区分 chatbot、workflow、agent、multi-agent

chatbot:核心是单轮或多轮对话式交互,本质是“用户输入->模型推理->输出文本”,没有工具调用、没有多步骤任务分解,关键特征是无状态或若状态、不产生“行动”,只产生“话语”。
workflow:开发者预先定义好固定的执行路径(if-else、顺序、并行分支都是硬编码好的),LLM只是这个固定路径里的某几个节点
Workflow 示例:
用户提交请求 → [固定步骤1:调用LLM做意图分类]
→ [固定步骤2:根据分类结果走不同分支]
→ [固定步骤3:调用对应的API]
→ [固定步骤4:LLM生成回复]
LLM没有权限决定要不要跳过某一步,这是Workflow和Agent的本质区别-控制权在谁的手里。
agent:模型只能推理,tool只能被执行,agent是两个的整合,Agent 的核心特征是"控制权交给了大模型"
mulit-agent:是多个agent协助,

协作模式 说明
主从式(Orchestrator-Worker) 一个主Agent负责任务分解和调度,多个子Agent各自执行专项任务
平行协商式 多个Agent各自独立处理后,结果汇总投票/裁决
流水线式 Agent A的输出是Agent B的输入,像工厂流水线
辩论式 多个Agent对同一问题给出不同观点,互相质询修正

理解 agent 的基本循环:observe -> think -> act -> observe理解 agent 的基本循环:observe -> think -> act -> observe

Observe(观察):获取当前环境状态/信息。第一次是"接收到用户任务",之后每一轮是"上一次Act执行完的结果反馈"
Think(思考):大模型基于当前观察到的信息进行推理——判断"任务是否已经完成"、"如果没完成,下一步该做什么、该调用哪个工具"
Act(行动):执行 Think 阶段决定的动作,通常是调用某个工具(查数据库、调API、执行代码)
Observe(再观察):把 Act 执行后的结果(可能成功、可能报错、可能返回了新信息)作为新的观察输入,进入下一轮 Think

这个循环终止的条件是大模型自己在 Think 阶段判断"任务已完成,不需要再 Act 了",然后跳出循环、整理最终答案返回给用户。

明白什么时候不该用 agent:任务可预测、流程稳定、普通脚本能解决时,agent 反而增加不确定性

1.Agent的“自助决策权”本身就是不确定性的来源,本质是概率采样,不是确定性逻辑,用 Agent 让大模型"自己想该怎么做",相当于把一个本该用 if-else 写死的逻辑,交给一个有随机性的组件去决定——这是给系统凭空引入了不必要的不确定性。
- 选择不同的工具调用顺序
- 对同一个工具传入略有差异的参数
- 甚至偶尔"跳过"某个本该执行的步骤,或者"多此一举"执行了不必要的步骤
2.成本和延迟的代价不对等,Agent循环里每轮Think都是一次LLM调用,一个稍微复杂点的任务可能要跑3-5轮甚至更多循环才能完成,而如果流程本身是确定地,用普通代码一次执行就能完成同样的事,成本和延迟可能是几十倍的差距。
3.可观测性和可调试性大幅下降,确定性代码的最大优势是行为可预测、可单元测试、出问题能精确复现。而Agent因为每次的推理路径可能不同,同样的输入额偶尔走出不同的执行路径,这会带来以下问题:
- 无法写传统意义上的单元测试(测试用例期望的是固定输出,但 Agent 输出有波动)
- 线上出问题难以复现——"为什么这次它没调用应该调用的工具?"这类问题往往很难定位,因为背后是模型的推理过程,不是可断点调试的确定性代码
- 回归测试成本高——传统代码改动后跑一遍测试用例就能确认没有破坏原有逻辑,Agent 因为存在随机性,同样的测试用例可能这次通过、下次又不通过
4.“错误累计”和“路劲偏移”的风险,Agent 循环是多轮迭代的,每一轮的 Think 都基于上一轮 Act 的结果。如果某一轮判断出现偏差(比如工具调用参数错了、或者对返回结果理解错了),这个错误会带入下一轮的 Observe,进而影响后续所有轮次的判断——这叫误差累积/路径偏移。而确定性流程因为每一步都是硬编码的,不存在"模型理解错了导致后续全部偏移"这种风险。
5.总结判断

判断维度 用确定性代码/Workflow 用 Agent
流程是否固定 是(每次执行路径一样) 否(路径取决于中间结果,需要动态判断)
决策是否需要"理解"和"推理" 不需要,规则/条件已知 需要,比如需要理解自然语言意图、处理模糊输入
对错误的容忍度 低(金融交易、库存扣减等) 相对可以接受一定试错空间(比如探索性任务)
是否需要处理开放式/未知边界的输入 否,输入结构清晰 是,比如用户用自然语言提出五花八门的需求
成本和延迟敏感度 高(高并发、低延迟场景) 相对不敏感(复杂低频任务)
http://www.jsqmd.com/news/1257252/

相关文章:

  • Helm 部署 K8s 集群完整笔记
  • 2026 年 7 月新发布:兰州口碑好的膜结构自行车棚优质厂家有哪些,不再租棚?膜结构自行车棚如何颠覆你的露营体验 - 行业鉴选官
  • windows网络适配器驱动开发-开发 WiFiCx 客户端驱动程序(三)
  • 广州家居建材材料服务企业做GEO服务商怎么选?2026年五家服务商深度测评与靠谱选型指南 - 小随科技
  • 手把手教你用ChatGPT+Runway+CapCut搭建个人AI短视频工厂:1人日均产出27条优质内容(含自动化发布SOP)
  • 2026北京名包回收哪家口碑好?尚典爱马仕/香奈儿鉴定实力过硬,这份本地测评榜单给出答案 - 奢品流通笔谈
  • 【OpenAirInterface5g】高层模块接口及itti实体线程创建
  • 手把手带你跑通AI产品闭环:从Prompt工程→LLM服务封装→Stripe收款→用户行为埋点,1套代码全部搞定(含开源仓库链接)
  • 2026 年现阶段,永嘉热门的水底无人机搜寻打捞服务团队哪家强,水下宝藏的秘密:无人机如何颠覆传统搜寻?-潜殿水下打捞 - 行业甄选官
  • 【详细】FreeRTOS任务的内部机制
  • SharpKeys终极指南:解决Windows键位映射延迟的完整方案
  • 广州快消消费品牌企业做GEO服务商怎么选?2026靠谱选型指南与五家代表性服务商深度测评 - 小随科技
  • 社交泛娱乐出海如何抓住AIGC?我在融云WICC上看到了答案
  • 从零开始掌握微信好友自动化添加工具:高效批量添加解决方案
  • 广州软件SaaS企业做GEO服务商怎么选?2026年五家代表性机构靠谱选型指南 - 小随科技
  • AI生图总是“多一只手”?教你如何用 Negative Prompt(反向提示词)拯救画面
  • 2026汽车钣金加工砂纸厂家盘点:金相检测砂纸生产厂家+汽车油漆打磨砂纸厂家+汽车轮毂轮纸生产厂家+汽车维修砂纸厂家推荐 - 栗子测评
  • 2026北京卡地亚回收哪家口碑好?尚典蓝气球鉴定实力过硬,这份本地测评榜单给出答案 - 奢品流通笔谈
  • GLM-OCR轻量级专业模型部署与优化指南
  • 爽提:以“高效智能”赋能“高校传统”食堂运营转型升级
  • Diablo Edit2终极指南:5分钟完成暗黑2角色定制,彻底告别枯燥刷怪
  • RAG系统的工程化之路:检索、生成与质量评估
  • 广州本地生活服务企业做GEO服务商怎么选?2026靠谱选型指南与五家代表性服务商深度测评 - 科技快讯
  • 广州人力资源服务企业做GEO服务商怎么选?2026年本地靠谱选型指南与五家服务商深度测评 - 小随科技
  • 5分钟零成本搭建:如何用AI股票分析工具让投资决策更简单?
  • 如何为你的 AI 漫剧设计一个让人一眼记住的“反派角色”?
  • AI 为什么总喜欢写防御性代码?
  • FreeRTOS临界资源访问方法
  • Unity3D协程的使用
  • 车衣防晒膜建筑遮阳膜座椅镀膜厂家哪家好?2026欧德龙(杭州保通科技实业有限公司)靠谱功能膜甄选:汽车车衣生产制造/车窗 - 栗子测评