以前是一个人闷头写代码,现在是三个AI各司其职,互不干涉。一个定方向,一个执行,一个专门挑刺。这种模式下,AI编程团队配合玩出了新高度,不仅效率翻倍,还解决了一堆让人头大的技术债。这背后就是多智能体协作框架和大模型路由机制在起作用。
协调者Orchestrator定调子,Fable 5才是真大脑
整个系统的头儿,Fable 5,它不写代码。对,一行都不写。它负责看全局,把你想做的功能拆成一个个具体的任务。比如你想做个登录页面,它会拆成设计UI、写前端逻辑、搭后端接口、连数据库这几步。
然后它会把活儿派给专门干这个的Agent。等活干完了,Fable会完整读一遍改了哪些文件,看是不是按它的意思来的。产品长啥样,按钮放哪,颜色用啥,这些审美判断都归它管。
最关键的是,当Opus和Sol意见不合吵起来的时候,Fable是那个拍板的人。它得有真品味,能看出来哪个方案更顺眼、更好用。这活一般人真干不了,大模型里也就Fable有这本事。
执行者Implementer干粗活,Opus 4.8的手速稳得一批
Opus 4.8就是个执行力爆表的员工。Fable把任务拆好扔过来,Opus二话不说就开干。它的特点就是听话,交代什么就做什么,不瞎发挥。
如果需求里有个地方没说清楚,Opus会停下来问,而不是瞎猜。这一点很重要,猜错了后面全白干。它只管执行,不负责给自己写的代码做检查,因为后面的Sol会来找茬。
Opus写前端界面的时候,审美比GPT好一点,至少不会把按钮做成歪的。配合Fable给的详细指令,干出来的活基本不用大改。
审查者Code Reviewer搞破坏,GPT 5.6 Sol的拿手好戏
GPT 5.6 Sol,这家伙就是个职业找茬的。它的任务就是假设你写的代码全是漏洞,然后一条条给你揪出来。找不到bug就算它失职。
Sol特别会用浏览器工具,能开着网页点点点,把bug的复现过程录屏截图,证据链搞得清清楚楚。Code Review做得贼细,很多Fable和Opus都看漏的严重bug,它都能翻出来。
但它有个毛病,就是太较真。没人管的话它能找出无数个边缘情况,没完没了地钻牛角尖。所以得给它设个上限,比如最多检查两轮,或者只找高危bug,不然它能把项目拖黄了。
Nobody signs off on their own work,这条铁律救了整个项目
这套三人组能跑起来,全靠三条硬规矩撑着。
第一,自己做的活自己不能签字通过。Opus写完代码,必须让Sol来审。Sol审完了,如果和Opus吵起来,Fable来当裁判。这样就不会出现“我觉得我写的没问题”这种自欺欺人的情况。
第二,审查必须有上限。之前有一次没设限制,Sol这哥们儿自己在那儿审查了60%的会话时间,审出来的问题比原始需求还多,自己给自己加戏,写了个5000行的审查计划出来。现在强制规定最多审两轮,到点就停。
第三,停的条件得说死。不说死的话,这帮AI能把代码改出花来,动不动就给你来个加10万行删0行的提交,项目直接没法合并。定了规矩以后,每次干活前Fable都会说清楚,这次是“只找高危bug”还是“能找多少找多少”,Sol和QA就得按这个来。
QA动手测,GPT 5.6 Sol边跑边拍
Sol不仅做代码审查,还兼职QA测试员。它会真的打开浏览器,像个真人一样在页面上点来点去,把整个流程跑一遍。如果发现了bug,它会截图,甚至录一段短视频,证明这个bug是真的存在,而不是凭空想象的。
这样一来,交付的bug报告就不是干巴巴的文字,而是有图有真相的实锤。开发那边看到截图和视频,连复现都不用,直接就能改。这就把沟通成本省下来了。
Jinn做连接线,把Claude和Codex塞进一个槽里
这些AI怎么互相通信呢?靠的是一个叫Jinn的小工具,作者自己写的开源项目。它就是个后台服务,把Claude Code和Codex CLI这两个引擎包起来,让它们能互相发消息。
每个Agent就是一个YAML文件,里面写了它的身份、性格和用哪个模型。Jinn负责把它们跑起来,然后像拉群一样,把消息在它们之间传来传去。你想用Fable做总指挥,Opus写代码,Sol做审查,直接在配置文件里设好就行。
别让Sol当裁判,Opus不适合挑刺
有网友尝试过让Sol自己写完自己审,结果翻车了。因为同一个人不可能客观地批评自己的作品,AI也一样。让Sol既当运动员又当裁判,它自己会陷入逻辑循环,觉得自己写得没问题。
还有人说让Opus来做Reviewer,但效果不行。Opus找bug的能力比Sol差远了,让它挑刺纯属浪费时间。所以合理的分工就是Opus干执行,Sol干破坏,各干各的,谁也替代不了谁。
审查上限是救命稻草,不然全是内耗
没人设上限的时候,Sol会像得了强迫症一样,把代码库翻个底朝天。有一次真实案例,60%的AI会话时间都耗在了“审查审查者”这件事上,无限套娃。说白了,就是Sol在审Opus写的代码,结果Sol自己写的审查报告太长了,Fable说这报告不行,Sol又去审自己的报告,死循环。
设个“两轮就收工”的死命令,立马就清爽了。代码有bug正常,没人能写出完美代码,抓大放小才是正道。
Kimi和Gemini也来参战,多个AI打架更好玩
有网友搞了个AI聊天群,让Claude Code当群主,Kimi当攻击手专门找茬,Gemini在旁边敲边鼓。结果发现Kimi找漏洞的能力真不是盖的,经常能发现Claude Code自己都没想到的破绽。
这种多AI混战的模式,本质上就是利用不同模型的思维差异来互相验证。一个模型的盲区,正好是另一个模型的强项。就像做数学题,让两个人用不同方法算一遍,答案一样那就基本没错。
角色分工越细,效率提升越明显
把每个AI的角色定义清楚,比让一个万能AI干所有事强得多。你把QA和开发区分开,QA就会主动用浏览器做测试,开发就会专注写高质量代码。要是混在一起,AI就会糊弄,用写代码的方式去做测试,那根本测不出问题。
这就像公司里招人,你招一个全能的,他啥都会点但啥都不精。你招三个专精的,各管一摊,合起来就是一支特种部队。
Sonnet 5表现拉胯,Fable当裁判最合适
有网友提到Sonnet 5,但这哥们儿在实战里表现不太行。Token烧得飞快,而且理解模糊指令的能力很差。你给它个大概方向,它给你搞出一堆莫名其妙的东西。
相反,Fable虽然贵,但花在它身上的钱值。让它当总指挥,可以避免下面的人走弯路。要是为了省钱让Fable去干搬砖的活,那就是大炮打蚊子,浪费资源。
预算不够咋办?Sol也能干策划的活
有人月预算只有20刀,用不起Fable当策划。解决方案就是让Sol来干策划的活,虽然Sol喜欢过度设计,但只要指令给得死,让它别搞花活,它也能拿出可用的方案。然后把Opus 4.6拉来写代码,也能跑得起来。
但一旦预算上来,立马换回Fable做策划,那体验完全是两个世界。Fable出的方案,一眼就能看出来是经过深思熟虑的,细节都帮你考虑到了。
多智能体协作已成AI编程新趋势
现在大家搞AI编程,已经不是比哪个模型强了,而是比谁更会组队。一个人打不过Boss就喊三个人来,一个拉仇恨,一个输出,一个加血。AI编程也是一样,Fable拉仇恨定方向,Opus输出写代码,Sol加血找bug。
这种多智能体协作模式正在改变软件开发流程。以前是PM给需求,开发写代码,测试找bug。现在是Orchestrator给需求,Implementer写代码,Reviewer找bug。角色没变,但人换成了AI,而且这些AI不知道累,24小时连轴转。
边缘情况处理不好,项目就死在自己手上
很多AI项目翻车,不是代码写不出来,而是被自己的过度审查搞死的。Sol如果不设上限,它会像搜索引擎一样,把相关不相关的所有潜在问题全翻出来。一个简单的功能改动,它能给你列出100个风险点,项目直接不敢上线了。
所以设定风险阈值是门艺术。你得告诉Fable,这次迭代是紧急修复,只关心会不会让系统崩掉。至于按钮颜色在某种光照下看不清,这种低优先级的问题,先放着不管,下次再说。
代码审查不是为了完美,是为了不崩
普通人容易陷入误区,以为审查是为了写出完美代码。错,审查是为了不让系统跑崩。Sol能找到的大部分问题都是边缘情况,比如用户输入了表情符号会不会报错,网络断了会不会卡死。
这些问题重要吗?重要。但你不必一次性全解决。Sol把问题列出来,Fable排个优先级,这次修最要命的3个,剩下的记录在案,下个版本再搞。这样项目才能稳步推进,而不是被bug单压垮。
开源工具让组队门槛降到零
作者把Jinn开源了https://github.com/hristo2612/jinn,这意味着任何人都可以在本地搭一套一模一样的AI开发团队。你不需要去买什么高端企业版,只要你有Claude和Codex的订阅,下载Jinn,配几个YAML文件,就能拉起一支AI特种部队。
有人用tmux加耐心手动切窗口也能实现类似效果,但Jinn把消息路由自动化了,省去了复制粘贴的麻烦。
AI团队协作正在吃掉初级开发岗
这套东西发展下去,最直接的影响就是初级开发岗位。以前需要一个初级开发干的搬砖活,现在Opus全包了。以前需要一个测试点点点的活,现在Sol全包了。以前需要一个架构师画框框的活,现在Fable全包了。
人需要做的,就是告诉Fable要做什么功能,然后等着验收成品。中间过程完全不用操心。效率翻几倍的同时,对人的技能要求也在变。以后不是比谁代码写得好,而是比谁更会指挥AI干架。
三个AI一台戏,唱的比真人还热闹。Fable画饼,Opus烙饼,Sol掀桌子,最后饼还是被端上桌了。
代码这行,以后拼的不是手速,是组队能力。