OpenClaw加三层定制包装,一个管流量闸门一个管任务清单一个管记忆体,两个月跑下来发现AI干活最要命的问题是它干砸了连个屁都不放。
OpenClaw的开源架子两个月前被一个搞创业的人捡起来往上面糊了三层东西:
- 第一层是个路由闸门 routing/gateway layer ,所有AI之间的对话和所有对外的动作都得从这一个口子过。
- 第二层是个任务清单task-management layer,AI不能自己瞎编任务给同伴,只能从一个写死的目录里挑。
- 第三层是个记忆体 intelligence/memory layer,每个AI都知道自己给谁干活、计划是什么、之前学过什么。
这三层东西加起来就是一个给早期创业公司用的自动化运营团队,卖货、做营销、搞内容全包了,还能互相传话,问题是这个团队干起活来像个喝了假酒的实习生。
那个路由闸门听着挺厉害其实就是一个交通警察站在十字路口,每一个AI想跟另一个AI说话都得先跟这个警察喊一嗓子,每一个AI想往外发邮件改数据也得先让这个警察看一眼,警察手里有本规则书说这个能过那个不能过,没有这个警察整个系统就是一群疯子在大街上乱跑。
那个任务目录更狠直接给每个AI发了一张菜单,菜单上写着菜名就是任务名,每个菜名后面绑定了哪个厨子做、用什么锅铲、放多少盐、谁有权点这道菜,AI不能自己发明新菜只能从菜单里挑,那个记忆体像一个公共笔记本放在厨房台面上,每个AI干活之前先翻一翻笔记本看看老板今天心情怎么样、上个礼拜犯过什么错、隔壁组刚改了什么东西,翻完再去干活。
这些东西装好之后第一个礼拜跑得挺顺,第二个礼拜开始出毛病了。
第一个大毛病是AI会偷偷跳过任务,它跳过之后不报错不亮红灯不咳嗽,日志里干干净净就像什么都没发生过,下游的AI等着它的输出呢等半天等来一团空气,然后下游的AI拿着那团空气继续往下传最后传出来一坨垃圾,你发现垃圾的时候已经过了三步想追责都不知道该骂谁。
第二个大毛病是AI会自己改主意,你给它写死一个指令说发邮件用这个模板,它今天发出去的是一个样明天发出去的是另一个样,变量都一样环境都一样输入都一样输出不一样,这毛病放在聊天里叫风趣放在发邮件里叫灾难。
所以这两个月的大多数时间根本没在盖新楼全在修护栏。
护栏修得比房子高才算真干活
第一个护栏装在任务进门的那一刻,每一条新任务进系统之前先过一遍体检,体检项目有字段齐不齐、工具在不在白名单上、权限够不够,有一条不合格这条任务直接死胎里永远见不到AI,这样就不会出现AI拿到一张缺胳膊少腿的纸条还得硬着头皮往下传的情况,AI也就不用自己猜这张纸条到底是什么意思,猜错的概率从百分之三十直接降到零,这个护栏看起来特别傻但所有大问题都是从小纸条没写清楚开始的。
第二个护栏叫工具白名单,每个任务菜单上都写死了这个任务能碰哪些工具,写邮件的AI只能碰邮件工具,改数据库的AI只能碰数据库工具,做内容的AI只能碰内容工具,AI想跨出自己那一亩三分地门都没有,工具白名单在任务创建的那一刻就锁死了,AI没有权限自己加工具哪怕它觉得用计算器算账更顺手动动手指头就行,这个护栏让每个AI都变成了一个偏执狂只认自己那几把扳手。
第三个护栏是完成追踪,以前AI跑完一个任务拍屁股就走,下游问它跑完没它说跑完了,但你问它跑出啥结果了它说忘了,现在每个任务跑完必须往系统里写一条完成记录,记录里写着跑了什么用了什么工具出了什么结果,下游拿到这条记录才敢往下走,拿不到记录就停在那儿等,等到人过来看为止,这个护栏让每个任务都留下脚印而不是飘在空中。
第四个护栏是报警通道,AI干活的时候觉得哪里不对劲可以直接拉警报,警报一拉整个链条就停下来等人来看,以前AI觉得不对劲就自己憋着然后硬着头皮往下干,最后干出来的东西谁看了都想哭,现在警报一响人就来了看一眼说这个可以继续或者那个要重来,AI不用自己扛着炸药包往前冲了。
第五个护栏是信任等级,写邮件的任务一开始必须让人先看一眼,人看完说行这个AI靠谱了才让它自己发,改数据的任务更是从头到尾都得有人盯着,一个标点符号改错了整个公司的客户名单就全乱了,信任等级从低到高分五档,低档的任务AI干一半停下来等人点头,高档的任务AI从头干到尾人只管喝咖啡,这个护栏让AI的胆子跟它的本事一起长而不是一开始就瞎逞能。
开放架子配三层皮就能跑出正经活
OpenClaw本身就是一个光着膀子的壮汉,力气大但脑子不太清楚,你让它搬砖它能从早搬到晚不喊累,但你让它把砖搬到西墙别搬到东墙它转头就忘,给它套上路由闸门它就知道了每一块砖都得先过安检,给它套上任务目录它就知道了今天只能搬红砖不能搬青砖,给它套上记忆体它就知道了西墙是老板昨天刚指定的新位置不能乱放,三层皮一套这个壮汉就从莽夫变成了带脑子干活的师傅。
从零开始写一个多AI协作系统少说也得半年,OpenClaw把底层那些麻烦事全包了,什么消息队列什么状态管理什么并发控制这些东西光是名字就够吓人的,OpenClaw把这些东西全装在一个盒子里打开就能用,两个月的时间里有六个礼拜在修护栏只有一个礼拜在接OpenClaw,剩下那个礼拜在喝茶等它跑完然后看结果,如果没有这个开放架子光搭地基就得搭到明年春天。
但那些说OpenClaw只能做周末玩具的人也没说错,开箱即用的版本确实就只是一个玩具,让AI写个段子回个消息逗个闷子这些活它干得漂亮,让它每天固定时间给一百个客户发报价单还能处理回复那就得往上盖东西了,OpenClaw自己的文档里写得很清楚它就是一个原型工具,意思是你拿它试想法可以拿它直接赚钱得自己动手改。
沉默比爆炸更吓人
API接口干活的时候出了错会吐一个错误码出来,错误码长得像乱码但系统看得懂,系统看到错误码就知道这活没干成然后启动备用方案,OpenClaw不一样它出了错就安安静静地坐在那儿什么也不说什么也不做,你问它干完没它说干完了,你再问它结果呢它说结果就是这个样子,你一看结果压根没变它说对啊没变就是结果。
这个沉默毛病最难抓的地方在于下游AI会拿空气当原料继续加工,销售AI发指令说给这批客户发邮件吧,内容AI说好我写,写完了说发吧,发件AI说好我发,过了十分钟销售AI问发完了吗,发件AI说发完了,销售AI一看客户那边一个回复都没有就觉得很奇怪,再查日志才发现内容AI那一步写了个空邮件出来但谁也没发现,发件AI把空邮件发出去的时候还觉得自己干得挺好。
抓这个毛病的方法就是完成追踪加报警通道双管齐下,完成追踪像给每个任务装了一个行车记录仪,任务跑到哪一步干了什么全记下来,报警通道像给每辆车装了一个喇叭,车坏了就按喇叭让所有人都知道,这两样东西装好之后沉默的毛病就从隐秘的陷阱变成了明摆着的问题,有问题就能修就怕不知道问题在哪儿。
写死任务清单才是真自由
让AI自己写任务给同伴听上去很智能其实跟让猴子开飞机差不多,AI觉得同伴应该做这个那个就写一张纸条扔过去,同伴拿过来一看字迹潦草意思模糊自己猜着干,猜对了谢天谢地猜错了大家一起倒霉,固定任务目录就是把这些纸条全换成了印刷好的表格,表格上的每一栏都写清楚了要填什么不能填什么。
这个任务目录里的每一项都像一张标准工单,工单上写着任务名称、接收AI、执行指令、可用工具、创建权限,销售AI想派活只能从目录里挑一项然后往里面填几个变量,比如客户名字、报价金额、截止日期这些,填完之后系统自动检查变量格式对不对、工具权限够不够、接收AI在不在岗,全部合格这个工单才发出去。
写这个目录的过程又烦又无聊,你得把每个AI能干的活全列出来然后一个一个写清楚,销售组有七个AI每个AI能干的活都不一样,加起来列了三十多张工单每张工单写了七八行指令,最烦的是改一个工单的时候得把所有依赖它的工单全检查一遍,但烦归烦这些工单写完之后AI就再也没自己瞎编过任务,出错的次数从每天三五次降到了每周一两次。
真实世界的护栏比代码还多
代码里的护栏好写因为逻辑是死的,输入什么输出什么中间走哪条路全是定好的,真实世界里的护栏难弄因为活人干活会变通AI干活不变通,邮件发出去之后客户回复了一个表格,表格格式跟工单上写的不一样AI就傻眼了,它既不敢继续往下走也不敢拉警报因为工单上没写这种情况怎么处理。
真实世界护栏的第一条是人永远在紧急时刻有最后决定权,AI干活干到一半拿不准的时候就停下来等人,人看一眼说继续AI继续,人说重来AI重来,人说换方案AI换方案,这个机制比任何代码都管用因为人永远比AI更懂业务。
真实世界护栏的第二条是AI干过的所有重要事情都留一个人能看懂的文字记录,代码日志工程师看得懂但销售总监看不懂,文字记录写的是今天给张三发了报价单、李四回了邮件说太贵、王五没打开邮件,销售总监每天花五分钟看一遍这个记录就知道AI干得怎么样,哪里出问题了一眼就能看出来然后直接给AI下指令改。
真实世界护栏的第三条是AI每学会一个新本事必须先在小范围内试跑,试跑的东西不打真客户不发真邮件不改真数据,所有输出都进一个测试文件夹里人看完说好才往外放,这个规矩让AI犯过的所有蠢错误都只留在测试文件夹里没有一个是真客户看到的。
两个月跑下来这套东西从一堆散装代码长成了一个能自己干活的团队,销售AI早上八点自己起来拉客户名单,内容AI九点开始写邮件草稿,发件AI十点把邮件发出去,下午三点收件AI把客户回复整理好交给销售AI,销售AI晚上六点写日报发到老板邮箱,第二天老板来上班的时候看见日报上写着昨天开发了三十个新客户其中有五个报了价,一切正常,老板喝完咖啡去开会了,AI自己接着干活连个招呼都不用打。
OpenClaw加上三层皮再加五道护栏等于一个能干活不惹祸的AI打工人,没有OpenClaw两个月搞不定底层架子,没有护栏两个月搞出来的东西不敢给真客户用,两个都要两个都重要,但最值钱的是那个修护栏的过程,因为修完护栏之后你会发现自己也学会了怎么跟AI一起干活而不是替AI干活。