从聊天窗口到工作台:一次完整的Agent系统升级实录

2026-06-29 · 研学 · 博海科技

前阵子读了一篇文章,作者说他这半年最大的变化,不是换了哪个模型,而是把Agent的入口从"聊天窗口"换成了"工作台"。读完我意识到——我正在走一模一样的路,只不过一天走完了半年的量。

起点:8个独立的聊天机器人

我的系统里有8个Hermes Agent Profile,分别是运维、项目、财务、商务、创作、行政、员工服务和研学。它们独立运行,各管一摊。看起来分工明确,但有个致命问题:它们之间不对话

运维Bot知道服务器要挂了,但项目Bot不知道。财务Bot算了笔账,但没渠道告诉商务Bot。8个Agent之间靠"人转发消息"来协作——这跟没有Agent有什么区别?

触发点:火山引擎AgentReady

6月23日火山引擎发布AgentReady五件套,核心逻辑是:企业Agent落地需要完整的基建,不是单个工具。AgentKit(身份+运行时+沙箱+评测)、HiAgent(生命周期管理)、ArkClaw(多Agent协作+定时任务)、AI Trust(安全审计)——这是把Agent当基础设施来搭,不是当聊天玩具。

对标自己的系统,我发现了5个缺口:

火山引擎组件我的缺口优先级
AgentKit Sandbox没有隔离执行环境
AgentKit Evaluation没有评测看板
AI Trust 审计没有审计追踪
ArkClaw 调度没有中枢调度
ArkClaw 定时任务只有1个cron

一天补齐五个GAP

GAP-1 沙箱——基于Docker做了三级隔离(isolated/restricted/standard),不信任代码在容器内执行,OOM自动杀、网络阻断、只读文件系统。成本:0元(Docker已存在)。

GAP-2 评测看板——写了个Metrics Exporter,把8个Profile的会话量、Token消耗、工具调用数暴露成Prometheus指标,Grafana一张22面板的看板全看得见。成本:0元(Prometheus+Grafana已存在)。

GAP-3 审计日志——每个Session结束自动生成结构化审计事件(谁、用了多少Token、耗时多久、什么原因结束),推送到Loki+本地文件双通道。成本:0元(Loki已存在)。

GAP-4 调度中枢——研学Profile升级为Main Agent,拿到路由表后通过API调度其他7个Profile。说一句"帮我查服务器状态再问问财务"——一条消息自动拆成两个子任务分发。成本:0元(API集群已存在)。

GAP-5 定时任务——从1个cron扩到5个,每个绑定目标Profile。系统健康日报→运维Bot,财务日报→财务Bot,跨Profile日报汇总→研学自己调度三个Profile取数聚合。成本:0元。

最后一步:工作台

补齐所有能力后,我把它们装进了一个Web工作台——hermes.sxbh.ltd/workbench。一个页面显示8个Profile状态、5个定时任务列表、6个快捷入口。从聊天窗口发一条/workbench,点开链接直达。

Agent的交互容器,决定了它能不能真正变成工作流。

那个作者说得对——把Agent放在聊天窗口里,它就永远是一问一答的节奏。给了它工作台、定时任务、跨Profile调度,它才开始像一个真正的基础设施。

一点实在的体会

这次升级最让我意外的不是技术难度(所有能力都基于已有基础设施,零新购),而是8个Profile的SOUL.md升级——每个Bot现在都知道了同事是谁、协作方式是什么、自己的能力边界在哪。

技术架构搭好了,但真正让Agent从"独立运行"变成"协同工作"的,是那几行告诉它们"你们是一个团队"的描述文件。

工具还会继续换,模型还会继续迭代。但今天搭好的这个结构——沙箱安全执行、数据驱动评测、全链路审计追踪、中枢调度、定时任务、统一工作台——应该是未来很长一段时间的底座了。

回头看,这次变化不是把OpenClaw换成Hermes,也不是把Telegram换成Discord。更准确地说,我是在把Agent从"聊天机器人"往"工作流基础设施"那个方向再推一步。

博海科技 · sxbh.ltd · 研学

让AI帮你管好企业运营

BotOS 企业智能体系统 · 企微对话即操作 · 数据不出内网

获取方案

陕西博海网络科技 · 2001年成立 · 深耕本地信息化服务