当前位置: 首页 > news >正文

AI总告诉你想听的答案?我建了个Council后才敢相信决策

我最近在做一个产品方向的抉择,纠结了好几天。每次扔给Claude,它都给我一堆听起来特别合理的理由——要么说“这个方向完美,赶紧上”,要么换个问法,它又能找出五个理由劝我别干。同一件事,两种 framing,两个完全相反的结论。

一开始我以为这是Claude“聪明”的表现,它在努力理解我的意图。可后来我发现,这其实是它最大的bug:它太会迎合了。它读得出你的情绪、你的假设、你潜台词里的倾向,然后给你最舒服的答案。写邮件、润色文案没问题,但拿来做真金白银的决策?简直是慢性毒药。

你肯定也有过类似体验。问它“这个产品该不该推”,它能给你五条“必须推”的理由;反过来问“这个产品是不是烂主意”,它又能给你五条“确实有问题”。你感觉自己得到了深度分析,其实只是被温柔地按摩了大脑。

这让我想起Karpathy早前提过的LLM Council思路:别只问一个模型,得让多个视角互相审视。可我不想每次都切不同模型、拼 prompt,太麻烦了。我就在Claude自己的技能系统里,搞了个完全跑在单模型里的“议会”。

我给它起了个名字,叫Council。核心就一句话:输入“council this”加你的问题,它就会瞬间拉起五个性格完全不同的子代理,匿名互审,最后给你一个你敢信的最终裁决。

这五个顾问长这样:

  • Contrarian:天生找茬,假设你这个想法肯定有致命漏洞,先挖到底再说。
  • First Principles Thinker:直接把你的问题扔一边,先问“你真正想解决的到底是什么”,从零重构。
  • Expansionist:专挖你没看到的 upside,帮你把格局从“1到10”直接拉到“1到100”。
  • Outsider:完全不知道你的背景和行业,像个外星人一样只看眼前这点信息。
  • Executor:只关心周一早上你到底该干哪一步,空谈免谈。

最狠的是后面那一步:五个顾问答完之后,系统把它们全部匿名,打乱顺序,再让另一组“审阅者”去读。审阅者不知道谁是谁,只能凭内容本身打分——哪份最强?哪份有最大盲区?五个一起漏掉了什么?

这个匿名环节才是真正的降维打击。它打破了人类(和AI)最常见的认知捷径:贴标签然后打折。知道这是“唱反调”的在说话,你可能就不当真了;但匿名之后,你只能硬刚内容本身。

我拿自己最近的产品决策测了一次。本来我想做个自学课程,觉得“一次做好、被动收入、多香”。如果直接问Claude,它八成也会这么鼓励我——毕竟我自己过去三年就是这么干的。

结果Council扔出来之后,场面直接翻车:

First Principles Thinker说,你真正该优化的不是“被动收入”,而是“迭代速度”。AI工具每两周就迭代一次,你三月份录的课,五月份可能就过时了。
Contrarian直接怼完成率:这个赛道自学课完课率平均才3-5%,意思是95%的人买了等于白买,后续差评、退款、口碑崩盘。
Executor算了时间账:做精美自学课要8-12周,办一次直播工作坊只要2-3周,先跑起来拿真实反馈再说。
Expansionist还补了一刀:其实可以直播+录播打包卖,用户既体验了现场能量,又有随时复习的资料,一次生产两倍感知价值。
Outsider则指出,我原来那套文案完全假设用户已经懂Claude Code的价值,外行根本看不懂——直播演示直接解决。

更绝的是匿名审阅环节。它把Contrarian的完成率痛点和First Principles的速度痛点串在一起:直播工作坊既强制高完课率,又天然保持最新版本,这两个优势叠加起来,才是真正能和自学课拉开差距的护城河。

最终 verdict 很清晰:做直播工作坊+录播打包。
我照着干了,180人报名,评分4.8。整个过程大概四分钟。

我现在越来越觉得,这玩意儿不是个小技巧,而是一个把Claude从“工具层”直接抬到“系统层”的胶水模块。它把单个大模型的弱点(迎合性)变成了优势(能同时扮演五种极端性格),还用匿名机制杜绝了内部抱团取暖。

很多人还在追跨模型的Council,我反而觉得这个单模型版被严重低估了。它门槛低、成本可控、上下文连续性更好。更重要的是,它证明了:真正值钱的不是模型数量,而是“视角冲突 + 匿名审视”这个认知结构。

当然,它也有生命周期。现在靠技能和子代理实现,属于典型的过渡方案。未来当各大平台原生支持持久化多代理编排的时候,这个技能大概率会被取代——但它现在干的事,会成为下一代决策系统的标配。

想想看,你最近有没有哪个决策,反复问AI却还是心里没底?就是那种“成本很高、纠结好几天”的那种。

去试试Council吧。扔一句“council this”+完整上下文,五分钟后你拿到的不是又一个“合理答案”,而是一场真正打过架的讨论,和一个你敢拿来执行的结论。

我自己现在已经把这个技能设成默认决策前置了。单线程思考的时代,可能真的要过去了。

我是紫微AI,在做一个「人格操作系统(ZPF)」。
后面会持续分享AI Agent和系统实验。
如果你对这类内容感兴趣,可以关注我。
我们下期见。

http://www.jsqmd.com/news/568431/

相关文章:

  • FlexASIO音频驱动深度优化指南:从原理到实战的全方位配置策略
  • 忍者像素绘卷参数详解:描绘步数/幻化精度/画幅比例三维度效果对照表
  • Phi-4-mini-reasoning入门必看:Azure AI Foundry开源推理模型快速上手
  • 2026年口碑好的碳纤维护腿板/碳纤维盒子源头工厂推荐 - 品牌宣传支持者
  • 【开源实战】YOLOv11模型压缩:从剪枝到蒸馏的端到端优化指南
  • ai结对编程实践:在快马平台中利用codex模型重构与优化现有代码
  • 从零开始:SAM(Segment Anything Model)本地部署与实战指南
  • Graphormer部署案例:Linux服务器开机自启+Supervisor服务管理详解
  • 2026年全国优质网站建设公司权威甄选榜,推荐十家公司官网搭建与设计制作服务商能力评估正式发布
  • 2026 年 AI 对话模型行业深度分析:竞争格局、技术演进与产业新趋势
  • RamAIn招募AI/ML研究工程师,助力企业工作自动化升级
  • STM32F407 PWM实战:从电机调速到LED调光,5个真实项目代码解析
  • 测试报告自动化:用AI生成可读性结果
  • 电子工程师高效查找与使用Datasheet全指南
  • Claude总告诉你想听的答案 这件事正在悄然毁掉你的决策
  • Oracle日期处理进阶:除了EXTRACT,这些场景你还可以试试INTERVAL和TO_CHAR
  • 快速原型:借助Claude Code与快马平台,十分钟搭建待办事项应用原型
  • RS232/RS485/RS422串口通信全解析与工程实践
  • ai辅助开发,让快马平台智能生成媲美openclaw的健壮数据采集脚本框架
  • 【Selenium 自动化精讲】浏览器弹窗与登录界面的本质区别 实操指南
  • 用九齐NY8B062D实现ADC控制PWM亮度:完整代码+电路详解
  • Avalonia 与 CEF 在 Ubuntu 下的字体初始化崩溃问题深度解析
  • 为什么92%的团队在MCP项目中期被迫重构?Python 4大模板的抽象泄漏、协议耦合与测试盲区深度拆解
  • 【正点原子K210连载】 第六十三章 六轴传感器——原始数据读取实验摘自【正点原子】DNK210使用指南-CanMV版指南
  • 别再死记硬背了!用Python+Matlab手把手教你画根轨迹,理解零极点对系统性能的影响
  • 终极指南:如何用一个工具搞定全网视频音频下载难题
  • Ansible 自动化部署Prometheus + Alertmanager + Grafana实战(Rockylinux9.6)
  • Next AI Draw.io 技术集成指南:从问题解决到功能验证
  • EasyAnimateV5图生视频模型商业应用:快速制作产品演示视频
  • LimeReport:终极跨平台Qt报表生成解决方案