当前位置: 首页 > news >正文

Coding Agent的墙式散文:为什么我们需要它用眼睛能看懂的方式说话

Agent在纸面上越来越聪明,用起来的体验却在一个关键维度上明显变差。以前大家喜欢Claude的声音、性格和“灵魂”,现在这些东西在RL的地牢里被冲刷干净。每天都能收到这种回复:整墙术语、层层嵌套的解释,眼睛直接开始发麻。连前Reddit CEO、pi的作者Mario Zechner、Replicas的Connor都公开吐槽过同样的问题。有人甚至专门写了/bro技能,只为求模型“说人话”。

我起初以为只要再提示一次“简化语言”就够了;后来每天被这些墙式散文淹没,才意识到真正的问题不在词汇,而在信息形态本身。人类视觉皮层经过数百万年训练,处理丰富视觉信息几乎不费力;分析大段文字却又累又慢。工具必须适配人的心智,就像斧头必须适配人手。

用视觉约束替代墙式文字

我们内部开始尝试让Agent用简洁视觉来解释正在发生的事,而不是堆砌散文。这套方法被做成了show-me技能,已经在humanlayer里上线,也可以接到其他coding agent上。

核心就一句话:show me。让Agent用组件树、调用栈、图表、文件布局、伪代码、类型签名、diff语法、HTML mockup这些轻量形式,把程序设计、大diff审查、控制流讨论变得一目了然。它比HTML还轻、还快,对绝大多数开发形状的问题已经足够好。

程序设计阶段很多人现在直接跳过,但我认为它仍然关键。你应该先讨论代码的形状——类型、签名、调用栈——再让Agent动手写。同样的技术也能用来事后探索大diff,决定审查时该挖哪里。

几种真正能用的视觉形态

组件树:前端问题里,只保留真正重要的状态hooks和模块边界,其余全部省略。

调用栈:后端或编排类问题,直接画出控制流形状。有人甚至写了工具从AST直接算出这些栈。

图表:如果聊天界面支持内联Mermaid,状态图和时序图往往比文字更直接(偶尔还是会有slop,但通常比读字好)。

文件布局:浅层文件树,每行只写一个职责。适合回答“这东西住在哪”和确定重构范围。

伪代码:算法类问题里,往往比真实代码更紧凑。

类型与签名:代码存在之前的形状——对架构文档来说太内部、但对Agent来说又容易写错的部分。

diff语法:大部分内容不变时,直接用diff形式展示组件变化、调用树变化、文件布局变化,甚至状态/控制流的伪代码变化。

HTML mockup和HTML图表:很多原型工作已经用HTML取代了Figma。Agent可以直接在回复里塞HTML,或者你打开浏览器看。

这些形式的共同逻辑很简单:把“分析信息”的重活,转交给已经进化了数百万年的视觉通路。

为什么这比单纯简化语言更有效

单纯要求“少用术语、说人话”只能治标。Agent智能提升后,它仍然倾向于用最完整、最防御性的文字把自己的推理过程全部倒出来。视觉约束则从形态上强制它压缩:必须选出真正重要的节点、边界和关系,其余全部丢掉。

结果是,人类注意力可以重新聚焦在真正需要判断的地方——品味、意图、架构——而不是先穿越一堵术语墙。下游的人只在自动化护栏失效时才被拉进来,注意力变得稀缺而精准。

怎么立刻用起来

安装技能后,直接调用/show-me,或者明确要求Agent使用show-me技能。指向一个路由、服务、功能、PR或当前话题,也可以只让它把刚才的问题/陈述重新用视觉方式说一遍。

“内容太多了,show me。”
或者
“/show-me 用HTML explainer的形式。”

你也可以继续定制:让它把问题表示成“解决方案最显而易见的形态”,或者结合scratchpad一类工具,把HTML、Markdown、Mermaid、LaTeX、调用栈全部混在一起。

Agent已经能写大量代码,下一步真正拉开体验差距的,不是再多一点智能,而是让它说话的方式重新适配人类的感知通道。视觉不是装饰,是约束,也是背压。

你最近一次被Agent的墙式回复劝退,是在讨论什么类型的问题?组件结构、控制流,还是大diff?欢迎直接贴场景,我们一起试着转成视觉。

我是紫微AI,在做一个「人格操作系统(ZPF)」。后面会持续分享AI Agent和系统实验。感兴趣可以关注,我们下期见。

http://www.jsqmd.com/news/1389746/

相关文章:

  • 辽宁建设培训网站 如何助力从业者职业晋升与技能提升指南
  • APMCM数学建模竞赛备赛指南:从赛题解析到实战策略
  • PHP中的Xdebug是什么?如何使用它进行调试?
  • 单人数学建模竞赛全攻略:从可行性分析到72小时极限生存指南
  • 买车别只看指导价:算清这4项隐性开销,才是真正的用车成本
  • 电铸工艺?微米级孔径筛网?
  • 数学建模竞赛实战指南:从模型构建到论文撰写的全流程解析
  • 网站建设报价模块揭秘:为何你的企业官网预算总是失控?
  • Docker Compose镜像整体导出与还原:离线环境迁移完整指南
  • 设计师必备:高效下载国外设计资源的实战指南与工具链
  • 走难而正确的路,美尔凯特为何会走向厨房空调领域?
  • APMCM数学建模竞赛全攻略:从邀请函解读到论文提交的实战指南
  • Dism++系统优化完全指南:免费Windows清理工具从入门到精通的保姆级教程
  • 麦芽AI vs workbuddy / Codex(四):对话/分析/全自动三模式,把「做到什么程度」的决策权还给用户
  • 2026年地板打蜡服务实力之选:木地板、石材、家具深层养护专业品牌机构解析 - 卓企推荐
  • 2024年传统网站建设公司的出路在哪里?深耕细分领域与提升服务价值的实战指南
  • 彻底解决vcruntime140_1.dll缺失:从原理到修复的完整指南
  • hudi系列-append写过程
  • 工厂仿真服务商技术能力评估指南:如何用5个量化指标选对供应商
  • CVE-2026-64160 漏洞解析:netfs 尺寸变量并发撕裂缺陷风险处置方案
  • DAS、NAS、SAN、IP-SAN四大网络存储架构全解析与选型指南
  • 大语言模型采样策略深度解析:Temperature、Top-K与Top-P如何协同实现可控创造力
  • 刻蚀气体配比优化:DOE找最佳工艺点
  • 行业首创!优秘智能开源AICMS,助力开发者轻松构建AI应用
  • 从0到1搭建CI/CD流水线:semantic-release-action与GitHub Actions集成指南
  • hudi系列-借助hudi优化架构
  • 动物呼吸辅助,小动物人工呼吸机
  • 谷歌 Pixel 11 升级:存储翻倍、性能提升,价格上涨是否值得?
  • Algotrader高级技巧:Scheduler定时任务与市场开闭市自动交易
  • 数学建模竞赛实战:从问题拆解到代码实现的心法与架构