前阵子读了一篇文章,作者说他这半年最大的变化,不是换了哪个模型,而是把Agent的入口从"聊天窗口"换成了"工作台"。读完我意识到——我正在走一模一样的路,只不过一天走完了半年的量。
我的系统里有8个Hermes Agent Profile,分别是运维、项目、财务、商务、创作、行政、员工服务和研学。它们独立运行,各管一摊。看起来分工明确,但有个致命问题:它们之间不对话。
运维Bot知道服务器要挂了,但项目Bot不知道。财务Bot算了笔账,但没渠道告诉商务Bot。8个Agent之间靠"人转发消息"来协作——这跟没有Agent有什么区别?
6月23日火山引擎发布AgentReady五件套,核心逻辑是:企业Agent落地需要完整的基建,不是单个工具。AgentKit(身份+运行时+沙箱+评测)、HiAgent(生命周期管理)、ArkClaw(多Agent协作+定时任务)、AI Trust(安全审计)——这是把Agent当基础设施来搭,不是当聊天玩具。
对标自己的系统,我发现了5个缺口:
| 火山引擎组件 | 我的缺口 | 优先级 |
|---|---|---|
| AgentKit Sandbox | 没有隔离执行环境 | 高 |
| AgentKit Evaluation | 没有评测看板 | 高 |
| AI Trust 审计 | 没有审计追踪 | 高 |
| ArkClaw 调度 | 没有中枢调度 | 中 |
| ArkClaw 定时任务 | 只有1个cron | 中 |
GAP-1 沙箱——基于Docker做了三级隔离(isolated/restricted/standard),不信任代码在容器内执行,OOM自动杀、网络阻断、只读文件系统。成本:0元(Docker已存在)。
GAP-2 评测看板——写了个Metrics Exporter,把8个Profile的会话量、Token消耗、工具调用数暴露成Prometheus指标,Grafana一张22面板的看板全看得见。成本:0元(Prometheus+Grafana已存在)。
GAP-3 审计日志——每个Session结束自动生成结构化审计事件(谁、用了多少Token、耗时多久、什么原因结束),推送到Loki+本地文件双通道。成本:0元(Loki已存在)。
GAP-4 调度中枢——研学Profile升级为Main Agent,拿到路由表后通过API调度其他7个Profile。说一句"帮我查服务器状态再问问财务"——一条消息自动拆成两个子任务分发。成本:0元(API集群已存在)。
GAP-5 定时任务——从1个cron扩到5个,每个绑定目标Profile。系统健康日报→运维Bot,财务日报→财务Bot,跨Profile日报汇总→研学自己调度三个Profile取数聚合。成本:0元。
补齐所有能力后,我把它们装进了一个Web工作台——hermes.sxbh.ltd/workbench。一个页面显示8个Profile状态、5个定时任务列表、6个快捷入口。从聊天窗口发一条/workbench,点开链接直达。
那个作者说得对——把Agent放在聊天窗口里,它就永远是一问一答的节奏。给了它工作台、定时任务、跨Profile调度,它才开始像一个真正的基础设施。
这次升级最让我意外的不是技术难度(所有能力都基于已有基础设施,零新购),而是8个Profile的SOUL.md升级——每个Bot现在都知道了同事是谁、协作方式是什么、自己的能力边界在哪。
技术架构搭好了,但真正让Agent从"独立运行"变成"协同工作"的,是那几行告诉它们"你们是一个团队"的描述文件。
工具还会继续换,模型还会继续迭代。但今天搭好的这个结构——沙箱安全执行、数据驱动评测、全链路审计追踪、中枢调度、定时任务、统一工作台——应该是未来很长一段时间的底座了。
博海科技 · sxbh.ltd · 研学