Openclaw最近几个版本更新后,执行任务疯狂跑偏,明明装了自学习技能还是把广告预算改成了负值。
最近Reddit上有个帖子火了,一个做保健品的老哥被逼到女儿刚出生还在改代码,最后靠四个技能包把团队从崩盘边缘拉了回来。评论区有人直接拿去用说“救了大命”,也有人吐槽“越用越卡”。今天把这四个技能拆开了讲,每个技能的核心原文先贴出来,再告诉你什么场景该用、什么场景用了反而添乱。
方向不对,跑得越快死得越惨
先看这个技能的原文核心部分:
# Direction Clarifier
Use this skill when acting immediately is likely to push the work the wrong way.
Core rule
Do not ask broad exploratory questions when one tight decision will unlock the right path.
When the direction is materially unclear, ask:
- one concise question
- two real options
- one recommendation
- one third path for "other"
The decision pattern
Ask in this shape:
*Question* — what decision actually matters?
*Option 1* — real path with concrete consequence
*Option 2* — real path with concrete consequence
*Recommendation* — say which option you recommend and why
*Other* — leave room for a third direction if the user wants it
这个技能解决的是最要命的问题:AI收到模糊指令时瞎猜。你让它“搞定广告素材”,它可能去爬竞品网站、可能打开PS乱改、也可能直接删除旧素材。方向没定,越努力越离谱。
规矩很简单,当AI自己都觉得“这活可能干偏”的时候,必须停下来问。但问法有讲究。不是甩一句“你想怎么搞”给用户,而是给出具体选择。
比如收到“提升转化”的指令,AI应该这么回:选项一,改落地页文案,历史数据能涨12%转化,但要花半小时;
选项二,调广告出价,五分钟见效但波动大;
我推荐选项一,因为上次这么干稳住了。你要有别的想法告诉我。
这套操作把“猜谜”变成了“选择题”。但评论区有个老哥说得好,这技能用多了纯属拖后腿。查天气、回邮件这种小破事,硬要启动方向确认,用户烦AI也烦。判断标准就一条:任务涉及外部系统改动、跨智能体协作、或者历史上有过翻车记录,才值得上这套流程。日常琐事让AI自己拿主意,错了也能秒改。
别让大管家变成全能保姆
Routing Enforcer的原文核心是这几段:
# Routing Enforcer
Use this skill to keep work in the right lane.
Core rule
Do not keep substantive execution inside the orchestrator when a specialist lane clearly exists and the specialist path is the better fit.
What to lock early
For qualifying tasks, decide:
*Real task type* — what kind of work this actually is
*Best owner* — which specialist should own the substantive lane
*Orchestrator role* — orchestrator, not accidental executor
*Split if needed* — what stays with the orchestrator vs what must leave the orchestrator
*Return condition* — what the specialist must bring back
多智能体系统里最经典的摆烂现场:大管家看创意智能体干活慢,自己上手剪视频;看数据智能体算得慢,自己写SQL。结果大管家忙到冒烟,专业智能体在旁边看戏,最后活全干歪了。
这个技能就干一件事:把活扔给该干的人。网页爬虫类归浏览智能体,数据报表归数据智能体,文案创作归文案智能体。大管家的本职是调度、追踪、验收,不是全能打杂王。
但评论区有个搞单机跑任务的老哥直接说,这技能对他就是废纸。他就一个主智能体带几个小工具,哪来的角色分工?硬套路由规则反而多此一举。所以用不用这套,看一个指标就够了:大管家是不是经常在干不属于它的活?是就上规则,不是就别瞎折腾。小团队单机版,省掉这层反而跑得更快。
五把锁把AI焊死在正轨上
Outcome Guard是整个方案里最硬的干货,原文核心如下:
# Outcome Guard
Use this skill to stop drift.
Core standard
Do not confuse any of these with completion:
- understood the task
- made a plan
- delegated it
- got a partial artifact
- posted a polished update
- received a vague "done" from another agent
The task is only complete when the requested outcome has landed and the done test passes.
The 5-part control frame
1. Outcome lock
State what must be true in the world when the task is done.
Prefer observable state changes over activity descriptions.
2. Owner lock
Name the real owner now.
3. Done-test lock
Define the smallest meaningful proof of completion.
4. Next-move lock
Never leave a qualifying task in a shapeless "in progress" state.
5. Recovery lock
Before drift happens, decide the recovery move.
这五把锁从任务启动到结束,把每个坑都堵死。第一把锁定结果,不说“检查素材”,要说“素材在网盘A文件夹存在,文件名含版本号,大小小于50MB”。第二把锁定责任人,一个任务只能有一个唯一负责人,多人协作也得明确当前接力棒在谁手里。第三把锁定完成测试,定义最小可验证的证据,文件链接、系统状态变更、测试通过,什么都可以但必须是硬证据。
第四把锁定下一步动作,永远不允许任务处于“进行中”这种模糊状态。要么有具体的下一步操作,要么明确卡在哪个环节。第五把锁定恢复路径,提前想好如果跑偏了怎么救,是重新澄清需求还是换人干还是拆成小块。
这套规则最狠的地方在于,它把AI之间的“我懂了”“快了”“差不多了”全判了死刑。只有硬证据能证明完成,其他全是幻觉。但原文也说了,别给单步可逆的小任务上这套枷锁,比如让AI改个错别字,你搞五把锁纯属闲得慌。判断标准:任务涉及多个系统、多个智能体、或者历史上经常跑偏,才值得全套上锁。
你信它说“好了”?它自己都不信
最后一个技能专门对付虚假完成,原文核心:
# Completion Verifier
Use this skill to stop false completion.
Core rule
Do not mark work complete until the claimed outcome is verified in the place that matters.
Verification frame
For any qualifying task, check:
*Claimed outcome* — what is supposedly complete
*Target location/state* — where the result must exist
*Proof* — what observable evidence confirms it
*Constraint check* — what must also be true for it to count
*Gap* — what remains unverified, if anything
Openclaw系统里最经典的翻车现场:创意智能体说“素材渲染完了”,大管家直接发给用户。用户打开一看,要么是半成品,要么传错文件夹,要么压根没上传。这叫虚假完成,是整个系统里最隐蔽的效率杀手。
这个技能强制要求,任何智能体说“完成”之前,必须去目标系统里亲眼验证。素材说上传了网盘,就去网盘查文件存在且路径正确。数据说更新了表格,就去表格里查单元格数值变了。广告说发布了,就去广告后台查状态是“投放中”。而且不能只看存在,还要检查版本、权限、格式、审批状态这些约束条件。
如果验证不了全部,必须明确说出来哪部分验证了哪部分没验证,差什么证据。只要还有缺口,任务就保持开启,绝不允许用“应该好了”糊弄过去。但原文同样强调,别对本地小编辑、低风险临时任务过度验证。你改个本地文档的错字,肉眼都能看到结果,硬要跑一遍验证流程纯属浪费时间。把验证资源留给那些“远程系统变更、多步协作、历史翻车率高”的任务,才能把效率拉满。
四套技能摆在这,各有各的适用场景。Direction Clarifier解决方向模糊,Routing Enforcer解决角色乱套,Outcome Guard解决执行跑偏,Completion Verifier解决虚假完成。但别傻乎乎全装上。单机跑简单任务的,方向确认和验证这两个可以保留,路由和五把锁反而拖速度。复杂多智能体电商系统的,五把锁和验证是保命符,方向和路由是标配。评论区那个老哥说得对,技能包不是越多越好,是根据你的任务复杂度和历史翻车率来搭配的。用对了是神器,用错了是枷锁。