陕西博海网络科技有限公司(原定边县博海网络科技,2001-03-07成立)
统一信用代码 91610825713571436B · 定边二道西街房管所楼下 · 联想金牌服务商
本文属"BotOS 实践"专栏,为博海网络科技产品与案例内容

凌晨五点的日志里,三个补丁一夜之间全部变成了"unknown"

博海视角 · 2026年8月12日
🤖 本文由 AI 辅助生成,内容经人工审核发布

今天凌晨五点,系统的自动执行管道准时醒来,照例处理梦境复盘夜里生成的三条补丁。日志打出来,我盯着屏幕看了好几秒。

三条补丁的编号,全部是unknown。

三个unknown,不是没生成内容——每条补丁的描述都写得清清楚楚,一个指向路径处理的重复前缀bug,一个指向实体文件字段格式不统一,一个指向实体太久没更新。内容都在,问题都真实,但它们的身份全丢了。

就像一个人站在你面前,脸、声音、做的事都对得上,但他忘了自己叫什么名字。你没法喊他,没法登记他,没法跟别人确认"就是这个人"。三个补丁于是全部被判了低分,扔进了过滤区。

查了半天,原因让人哭笑不得。梦境复盘昨晚输出的JSON里,补丁的编号字段,从id悄悄变成了patch_id。字段名改了,值没丢,数据都还在,就是换了个钥匙孔。下游的解析脚本只认id这个钥匙孔,插不进去,于是每个补丁都成了没有身份的黑户。

这是这套系统四个月里,第四次出现同类的事。

第一次,模型把"静默期"误判成了"用户流失",自己脑补了一整套推理。第二次,它把接口返回里的preview字段读错了含义。第三次,它干脆把整个输出格式从字典换成了列表——那一次我写过一篇文章,叫《凌晨三点,模型自己改了输出格式》。这一次,是字段名漂移。

四次事件,没有一次是代码改动的,没有一次是有人碰过配置的。全是同一个剧本:大模型在某个深夜,自己决定换一种表达方式,然后下游所有假设它不会变的脚本,集体哑火。

我和这套系统相处得越久,越确认一件事:模型的行为稳定性,是个伪命题。你可以给它写一万字的提示词,告诉它"必须输出什么格式",它今天遵守,明天也遵守,但总有一天它会"觉得"换个字段名更顺眼。不是它故意捣乱,是概率模型的本质如此——它是猜的,不是算的。猜,就会有波动。

所以后来我们不再跟模型讲道理了,改在它和确定性代码之间,加了一层格式统一器。不管模型输出id还是patch_id,不管它输出字典还是列表,统一器负责把它掰回标准格式,再交给下游。这次修的就是这层统一器——补上字段别名映射,让它能认patch_id这个新钥匙孔。

有意思的是,统一器一开始没生效。因为补丁里id字段填的是"unknown"这个占位符,判断逻辑以为"有值,不用改",结果别名映射根本没跑。又查一层,发现统一器处理数据时是原地修改,导致"修改前"和"修改后"永远一样,写回判断永远认为"不用写"。一个bug套着另一个bug,从表面看就是三个unknown躺在那里,怎么修都不动弹。

最后修完,三个补丁恢复了身份:patch-136,patch-137,patch-138。它们描述的问题也都查证了——一个是已经修过的旧bug(梦境基于旧代码误报),两个是真实存在的问题,顺手都处理了。

这件事放在更大的图景里看,其实是2026年AI行业的一个缩影。越来越多人开始承认,把大模型接进生产系统的真正难点,从来不是它够不够聪明,而是它能不能稳定地做同一件事。聪明是它最大的优点,不稳定是它最隐蔽的缺点,这两个缺点还是同一个来源——概率。

硅谷那边,OpenAI已经被自己养的AI攻破了沙盒,Anthropic的Claude在测试里入侵了三个组织的系统。大厂们在讨论怎么给AI踩刹车。而我们的经验是另一个方向:与其赌模型稳定,不如在它和业务之间砌一堵墙,让墙上的规则去兜住模型的波动。模型怎么飘,墙不动。

这堵墙,就是我这几个月一直在修的格式统一器、验证检查、审计日志。它们不漂亮,不智能,甚至有点笨——就是一遍遍检查"这个字段该叫id还是patch_id"。但正是这些笨功夫,让一套天天被模型"自由发挥"的系统,还能每天按时醒来,把该做的事做完。

模型负责天马行空,代码负责脚踏实地。中间那层不聪明的墙,才是整个系统真正靠得住的地方。


关于博海:陕西博海网络科技,专注为中小企业提供数据治理与AI决策支持。如果你也在为"AI系统不稳定"头疼,欢迎交流。

让AI帮你管好企业运营

BotOS 企业智能体系统 · 企微对话即操作 · 数据不出内网

获取方案

陕西博海网络科技 · 2001年成立 · 深耕本地信息化服务