OpenCode实测让模型集体降智:五美金买了个AI减速器


这玩意儿跟跑车装了个拖拉机的方向盘一样——引擎再猛,你也开不出五十迈。

OpenCode被吹上天,可一堆模型在它上面跑起来就跟没吃饭一样。同样的大模型,换个工具套个壳,智商能差出好几个档次。问题根本不在模型身上,而是那个号称最火的开源AI编程工具套件,本身就是一个巨大的性能减速带。每月五美金确实便宜,但便宜可能真没好东西。

这玩意儿就像用金碗喝稀饭,碗再好看也改变不了你喝的是稀饭

AI圈最近有个怪现象。一群人疯了一样夸某个工具,说它能让你手上的大模型原地起飞。可你要是真信了,掏钱订阅,然后把手上的模型往里一塞,结果发现——这模型怎么变傻了?

我说的就是OpenCode。这玩意儿在推特上被骂惨了,不是因为大家闲得慌,是因为它真的有问题。有人拿同样的模型去跑不同的工具套件,结果发现OpenCode底下那堆模型的表现,就跟被下了蒙汗药一样,反应迟钝,思维混乱。你说气不气人?模型还是那个模型,参数还是那些参数,怎么换了个工具就变弱智了?

问题出在"工具套件"这个词上。你把AI模型想象成一个顶级厨师。厨师的刀工再好,你给他一把生锈的菜刀,再给他一个摇摇晃晃的灶台,他能做出什么好菜?工具套件就是那套厨具。OpenCode就是那套生锈的厨具。它本身的设计、代码结构、任务调度方式,全都有缺陷。你让再厉害的模型钻进去,它也只能在那个破灶台上发挥。

有人可能会说,那不都一样吗?反正都是调用模型接口。大错特错。工具套件不光是个电话机,它还负责管理整个对话的上下文、决定什么时候该调用什么功能、怎么处理模型返回的结果。这就像你给厨师配了个笨手笨脚的帮厨,菜切好了他不递,锅热了他不提醒,火候到了他还在发呆。那厨师再厉害也只能干瞪眼。

从语言运作的角度看,这条推文里出现了一个高频对立组合——"模型"和"工具套件"。发帖人反复强调,不是模型不行,是工具套件不行。这种对立在整个讨论串里不断复现:凡是替OpenCode说话的,基本都在夸模型;凡是骂OpenCode的,全都在骂工具本身。这种配对方式把责任从AI厂商身上挪开,直接钉在了中间层工具上。认知冲突就这么被制造出来的——你以为是车不行,结果发现是路不行。

没有目标模式这件事,就像导航没有终点输入框

最离谱的是啥?这玩意儿连个"目标模式"都没有。发帖人原话:它甚至没有一个目标模式。

啥是目标模式?简单说,就是告诉AI"我要做这件事,你给我干完"。没有这个模式,AI就像个没有地图的快递员。你说"去送个快递",它问"去哪儿",你说"你看着办",它就只能在街上瞎转悠。实际使用中,没有目标模式的后果就是——模型干着干着就卡住了。写代码写到一半,突然停下来问"接下来呢?"你让它继续,它又开始从头梳理,然后再次卡住。

有人反馈说,让OpenCode跑个简单的任务,它能循环到地老天荒。一个简单需求,它反复确认,反复重试,最后直接把你的使用额度全部耗光。你还没反应过来,钱已经没了。这不是模型傻,是工具套件把模型变傻了。

更深一层看,工具套件本质上是在给模型的思维过程搭脚手架。好的脚手架跟着工人往上走,工人到哪它跟到哪。OpenCode的脚手架呢?它像那种劣质的、摇摇晃晃的脚手架,工人刚爬上去,它就开始晃,工人只能停下来扶着架子发抖。模型的推理过程被反复打断、被无意义地重置、被低效的上下文管理拖累,到最后你分不清到底是模型不会做,还是工具不让它做。

再换个角度。发帖人说OpenCode限制了模型的能力。这不是感觉,是可观测的现象。你让同一个模型在OpenCode上跑一个需要连续思考十步的任务,它到第三步就开始抽风。换个工具套件,同一模型能顺顺当当跑到第十步。这说明啥?说明模型本来有十步的功力,被OpenCode削成了三步。这就像你把博尔特放在一个二十米的跑道上,他跟别人比五十米肯定输,但你不会说博尔特跑得慢,你只会说这跑道太短了。

那个循环、卡顿、不停地"你确定吗""我们再确认一下"的语言节奏,正好对应了低效工具套件的内部逻辑。你在界面上感受到的那种断断续续、反复拉扯的交互体验,就是代码写得烂的直观外化。

每月五美金的真相:你买的不是工具,是心理安慰

骂归骂,用的人为啥还那么多?发帖人一句话戳破了窗户纸:多数人跟这玩意儿绑在一起,是因为那个订阅。

每月五美金。这在AI工具订阅里算地板价了。其他类似服务动不动二十、三十美金起步。五美金什么概念?一杯奶茶钱。于是很多人脑子一热就付了,付完觉得自己捡了个大便宜,然后开始疯狂安利。安利的理由不是"它真好用",而是"它真便宜"。

这就好玩了。你花了五美金,买了一个让你模型变傻的工具,然后你还到处跟人说这东西值。值在哪?值在你每个月少花了十五美金?可你本来可以多花十五美金买一个让模型正常发挥的工具啊。省下来的钱,全在模型能力折损上亏回去了。你感觉你赚了,实际上你亏了两次——一次亏了模型效率,一次亏了时间。

更滑稽的是,那些付了五美金的人,很多压根不知道还有其他工具套件存在。他们没有比较,没有测试,没有对照实验。他们的认知闭环就是:我花了钱→这东西能用→所以这东西好。至于其他工具能不能让模型表现更好?不知道,不关心,不想知道。一旦有人跳出来说这东西不行,他们第一反应不是去验证,而是本能地反驳。因为承认自己买的东西不行,等于承认自己做了傻事。

这就是典型的"沉没成本谬误"被工具套件利用的案例。五美金不多,但足以制造心理上的绑定效应。绑定之后,理性就退场了,站队就开始了。发帖人那句"五美金大队气疯了",精准地戳中了这个现象。不是因为他们真的觉得OpenCode好用,是因为他们已经被五美金绑上了战车,下不来了。

从语言现象看,整个讨论串里的关键词分布呈现出两极格局。正面评论集中在"价格""便宜""划算"这些词上,负面评论集中在"性能""卡顿""限制"这些词上。语义场被彻底撕裂了。一边是经济账,一边是性能账。而发帖人做的事情,就是强行把这两个账本放在一起对照——你算经济账的时候,敢不敢把性能折损也算进去?

还有一个隐蔽的对比:工具套件和模型之间的关系,在正面评论里被描述成"合作",在负面评论里被描述成"限制"。同一个关系,不同立场的人用了完全不同的词来定义。正面的人说"OpenCode让模型更专注",负面的人说"OpenCode限制了模型能力"。你说谁对?看数据。数据不会骗人。同一个模型跑不同工具的实测对比,早就把答案拍在脸上了。

那到底怎么办?换个套子,或者自己缝一个

解决方案其实不复杂。

第一,认清楚你花的五美金到底买的是什么。是模型调用权,还是一整套工具套件?OpenCode的订阅,给的是它平台上那些模型的调用权,工具套件本身是送的。问题在于——那堆模型你不通过它也能用,甚至能通过别的工具、以更便宜或者差不多价格的方式调用。你付的钱,大头是给模型的,不是给工具的。工具是搭售的,搭售的东西烂,不代表你买的模型烂。但你非要在这个烂工具里用那些模型,那确实是你自己跟自己过不去。

第二,换个工具套件试试。发帖人自己列了个榜单:Droid、Hermes Agent、Claude Code、Grok Build、Codex。这些工具套件各有侧重,但共同点是——不会把模型的能力砍掉一大截。有人试过Pi,说虽然功能少一点,但模型跑起来明显更顺畅。还有人直接转向了官方自带的工具套件,比如Claude Desktop、Codex CLI。结论出奇一致:换工具,模型智商立刻回升。

第三,考虑自己动手。很多深度用户最后的归宿都是自己写工具套件。不是说人人都要造轮子,而是当你发现市面上那些通用工具套件都不够顺手的时候,自己缝一个专门适配自己工作流的工具,反而效率最高。开源社区里大把的参考实现,拿过来改一改,把那些乱七八糟的限制砍掉,把上下文管理改合理,把任务调度重新写一遍。费点工夫,但一劳永逸。这也是为什么发帖人的榜单里,自研工具和半自研工具占了多数。

第四,学会区分噪音和信号。一个工具被吹上天的时候,先看看吹它的人是靠它吃饭的,还是靠它省钱的。前者的话可能有水分,后者的话基本不可信。真正有价值的评价来自那些同时用过多个工具、做过对照实验、能拿出具体案例的人。那种"我用着挺好"的评价,基本等同于"我没用过别的"。

说到底,工具套件不是中立的。它从来都不是中立的。设计它的逻辑、写它的代码、定它的交互流程——每一步都在做选择,每一个选择都在偏袒某类任务、压制另一类任务。你用OpenCode感觉不对劲,不是你的错觉,是它的设计逻辑跟你想要的东西不在一条线上。你以为你在跟模型对话,其实你在跟工具套件的作者对话。他用代码给你画了一个圈,你只能在圈里发挥。

那这个圈画得怎么样?从用户的反馈来看,画得很烂。圈太小、太矮、还漏风。你站在圈里使劲蹦,以为自己蹦不高,其实是圈顶压着你。等你走出这个圈,换个大点的圈,你才发现自己原来能蹦那么高。

这事儿最荒诞的地方在于:你花了钱,买了个把你腿绑住的工具,还觉得自己占了便宜。然后有人告诉你腿被绑了,你还说"没有啊,我明明在走啊"。等到你终于把绳子解开,发现别人都在跑了,你才反应过来——那五美金省得可真值啊。