玩了三个月Agent,我发现它是个聪明的傻子

三个月前我开始认真折腾Agent。不是那种看看文档就走的玩法,是真的把手上的活——内容创作、数据分析、品牌管理——全部拆成workflow,搭了一套多Agent系统。架构图画得很漂亮,节点之间箭头清晰,每个Agent各司其职,看起来什么都能做。

三个月后回头看,我发现一个让人沮丧的事实:我花了一个月搭的系统,什么问题都没真的解决。

不是说它不工作。它工作得很好。每天自动抓取热点、生成文章、推送封面图,偶尔还能出几篇阅读量不错的稿子。但当我坐下来问自己——这些活没有Agent之前我做不了吗?做得慢多少?——答案是:和没有Agent之前差不多。

Agent帮我完成了"干活"的环节,但没有帮我解决"什么活值得干"的问题。

这就是我管它叫"聪明的傻子"的原因——看起来什么都会,仔细一看,其实什么都不会。

举两个最典型的例子。

第一个,选题。我搭了一个选题Agent,给它喂了行业文章、竞品分析、用户画像,让它每天从选题池里挑三个"最优选题"。输出格式很漂亮——标题、匹配的用户画像、预计阅读时长、为什么选它,写得头头是道。但它选出来的题,和随机选题池里随机抽三条的差距,几乎为零。因为它做的事本质上就是"用流畅的胡话填补理解的空白"——它不知道这篇文章对读者意味着什么,不知道写这个话题时作者心里有没有底气,它只是把格式填对了。

第二个,内容审核。我写了一个审核Agent,检查文章有没有模板化结尾、有没有"第一第二第三"的分点结构。跑了一遍,它告诉我"没有违规"。但我的读者一眼就看出来了——这篇又是老套路。Agent没有撒谎,它只是真的不知道"不违规"和"写得好"之间隔着多远。它的世界里只有规则,没有感觉。

这两个例子说穿了是一个问题:Agent有"用",但没有"体"。

"用"是它能做什么——写代码、搭流程、生成方案、审核内容。这些它做得比人快、比人标准,甚至在很多场景下比人可靠。但"体"是对问题本身的理解——这不是信息量的问题,是维度的问题。一个人做选题,他知道这个选题自己写过没、有没有底气写、读者看了会不会觉得"又在炒冷饭"。Agent不知道这些,因为它没有"体"。

佛家讲体用不二。体和用是一体的,不能分开。你把"用"做得再漂亮,没有"体"托着,就是空中楼阁。

这话我说得轻巧,但其实我自己就是先着了那个相的人。

架构图一画,workflow一搭,节点之间箭头一串——那种"我解决了问题"的错觉非常强烈。我当时甚至跟朋友展示说我做了一个多Agent系统,心里沾沾自喜。朋友问了句"它帮你省了多少时间?"我愣了一下,说不上来。因为答案是零。我花了一个月搭了一个能跑的系统,但我的核心问题——选题质量、内容深度、品牌表达的独特性——一个都没解决。

这也让我重新理解了我自己为什么要做"国学×CMA×Agent"这个组合。

一开始只是觉得这是三个我擅长又喜欢的方向,放在一起比较特别。现在回过头来看,这个组合的内在逻辑其实是:国学提供"体"——对人和事物的理解,知道什么值得做、什么是对的;CMA提供"用"的度量——数据反馈告诉我做对了没有、偏差了多少;Agent才是那个"器"——执行工具,把前面两层判断变成具体产出。

以前我把Agent放在最前面,因为它看起来最酷。现在我把Agent放在最后面,因为它就是个执行者。

执行者很重要。但我用三个月踩出来的坑告诉我:没有体和用的定见,再聪明的执行者也是傻子。

体用不二,不是口号,是一层层扒开自己才知道的东西。

Agent能做很多事,但它不知道什么事值得做。

这个"值得",才是人的那口气。

— 一切皆如