幽默图:中国开源模型霸占了这几天AI头条


看下面这张中国开源大模型轮换海报图,下面每句话都是称自家是当时这个参数规模的最强模型:


三天前DeepSeek刚扔完王炸,昨天Minimax、Qwen、Moonshot、Z.ai就排着队官宣“世界最强”。

但如果你只盯着海报,你就漏掉了真正有意思的东西——那张图底下的网友讨论区,藏着比广告词更硬的料。

本文不站队,只带你去Reddit的评论区溜一圈。

你会发现,这帮每天跑模型、烧显卡、盯着benchmark过日子的老哥,根本没把“最强”两个字当回事。他们在吵的是:Minimax发的根本不是语言模型,Qwen的团队被拆过两次,8GB显存就能跑的视频生成器到底算不算奇迹。这些细节,才是这场三天跟牌大战的底牌。

三天跟牌,跟的不是同一张牌

那张梗图最大的视觉误导,是让你以为所有厂商都在同一条赛道上抢跑。

DeepSeek发了一个语言模型,三天后Minimax、Qwen、Moonshot、Z.ai也发了语言模型,大家对着同一群用户喊“选我选我”。但评论区第一条高赞就把这个错觉捅破了。原话是:“对Minimax公平一点,他们悄悄把H3塞进去了,而且Qwen 3.8还没开放权重。”这句话的信息量比一整张海报都大。

H3是什么?它不是大语言模型,是个视频生成模型。也就是说,Minimax那天扔出来的东西,根本不在文本赛道里。你拿一张全是语言模型logo的梗图去套它,就好比把一辆赛车和一辆越野车放在同一条起跑线上,然后嘲笑它们长得不一样。网友立刻跟进补充:“Minimax发布的视频模型H3,绝对是同尺寸最强的视频模型。”甚至有人贴出实测数据——8GB显存的笔记本,16GB内存,就能跑通图生视频和文生视频。这个信息把整个叙事翻了过来。

那为什么Minimax要混在一堆语言模型里发?评论区给出了一个冷静的分析:这些实验室有时候会赌对手的性能和发布时间。如果你手里有一个特别炸的公告,可能会故意憋几天,等到竞品热度最高的时候扔出去,把对方的新闻周期直接压死。Minimax很可能就是算准了这个时间窗,拿一个非LLM的爆款去打LLM的擂台,让媒体和用户必须在同一时间线里同时讨论两家。这种错位竞争,比单纯喊“最强”高级多了。

Qwen的沉默与归来

Qwen出现在那张图里,社区的反应不是惊喜,而是“竟然还有”。一条评论写得直白:“我以为再也看不到小Qwen的发布了,没想到他们回来了,高兴自己错得离谱。”这种意外感背后,是一段没写进新闻稿的团队史。

评论区有人扒了背景:做Qwen 3.5的那个团队,在3.6做到一半的时候被拆散了,关键人物离职。后来3.7完全没开源,大家就猜新团队可能彻底转向闭源。毕竟前面几代小模型统治了小尺寸赛道,0.8B、2B、4B、9B、35B,几乎是本地玩家绕不开的选择。但3.7的缺席让社区一度以为这条产品线已经死了。现在Qwen 3.8突然冒出来,而且传闻里还带了个27B的尺寸,这不光是新品发布,更像是新团队在证明“我们还在”。

更值得玩味的是网友的追问:“他们为什么不跟进自己最受欢迎的模型?”有人接话:“Qwen 27B在本地模型讨论里太常见了,他们没理由放弃。”这句话点出了一个关键矛盾:厂商的宣发策略和社区的实际需求经常是两回事。海报上喊“世界最强”是为了拉投资、拉新用户,但评论区的人在乎的是“这个尺寸能不能塞进我的显卡”“推理速度有没有优化”“开源协议会不会变”。当厂商把注意力全放在营销词汇上的时候,社区早就把目光锁定了那个还没放出来的权重文件。

本地运行才是硬道理

在满屏“最强”的轰炸下,Minimax H3那条评论的转发量最高,因为它甩出了一个让所有人闭嘴的数字:8GB VRAM。

你能想象一个视频生成模型,在笔记本电脑上跑,而且显存只要8GB?

评论区直接炸了:“虽然它不是语言模型,但昨晚发布的H3,对本地用户来说简直是一头野兽。前沿级别的视频生成,就靠那点显存和16GB内存,还自带文生视频、图生视频、残影生视频全套功能。”

这就是社区的真实兴奋点。不是“世界最强”的虚词,而是“我的破电脑能跑什么”。那些天天跑模型的老哥,他们的快乐阈值很清楚:一个模型再强,如果只能云端调用或者需要A100集群,那它就是别人的玩具。只有能本地部署、能量化、能塞进消费级显卡的东西,才配得上“真香”两个字。

反过来看,那些喊“最强”却迟迟不放权重文件的厂商,在评论区得到的只有催促和怀疑。比如Qwen 3.8,大家都在问“开放权重了吗”“什么时候能下载”。甚至有人直接点名:“DeepSeek V4 Flash目前还是同尺寸最好的LLM,Qwen 3.8 Max还没开源,所以Kimi K3暂时还是第一。”你看,社区自己有一套排名体系,根本不看广告词。他们按尺寸分类、按开源状态筛选、按实测benchmark排序,海报上的“最强”在他们那里就是个无效输入。

尺寸战场上的诸侯割据

如果你把评论区所有关于“最强”的争论汇总,会发现一个有趣的现实:每个人都承认不存在一个绝对的冠军。有人挺DeepSeek V4 Flash,有人等Qwen 3.8 27B,有人看好Kimi K3,还有人押注GLM 5.3。他们吵的不是“谁是世界第一”,而是“在这个尺寸、这个类别、这个开源状态下,谁暂时领先”。

这种割据局面是怎么形成的?因为模型尺寸直接决定了部署成本。7B、27B、70B,不同量级对应不同显卡门槛。一个只能跑7B的用户,不会去关心70B的benchmark,他只关心7B里面谁写代码最稳。所以厂商的“for its size”策略,本质上是对准了这个真实需求。但问题出在,他们把这句话喊得太响、太重复,让外界误以为他们在玩文字游戏。实际上,社区是认“同尺寸最强”这个概念的,只不过他们不认广告,只认实测。

有人提到“GLM 5.3的引用今天到处出现在智谱的基础设施和GitHub上”,暗示Z.ai可能马上也有动作。
还有人预测“DeepSeek Pro在八月初”。

整个评论区就像一张实时更新的动态地图,每个玩家都在不同的尺寸格子里插旗。这种细颗粒度的竞争,比海报上的集体狂欢要复杂得多,也真实得多。

发布日的心理战

一条评论提出过一个值得细品的猜测:“我真心觉得这些实验室有时候会赌彼此的发布时间。如果他们手里有个特别炸的公告,可能会等上几天,就为了把竞品的新闻周期压下去。”这话如果成立,那张梗图上的“3 Days Later”就不是被动跟风,而是主动的战术卡位。

想象一下场景:DeepSeek定档周一发布,Minimax手里有个视频模型,本来周三就能发,但偏要拖到周四。目的是什么?是让周四的科技媒体把DeepSeek的报道挤到第二版,把头条让给H3。同样,Qwen可能也在等某个窗口,Moonshot和Z.ai都在算对方的步子。这种“掐秒表”的竞争,比单纯的技术竞赛更考验策略。

评论区有人用了一个电影术语——“墨西哥对峙”。所有人举着枪指着对方,谁先开枪谁吃亏,但你不动我也不动。只不过这场对峙里,枪换成了发布会日期,子弹换成了新闻通稿。而最终中枪的,是用户的注意力带宽。三天之内四场发布会,没几个人能真正消化完所有信息。大部分人只是记住了logo和“最强”两个字,具体谁发了什么,完全模糊。这正是心理战想要的效果——用密集轰炸制造认知混乱,让用户记不住细节,只留下“这个行业很热闹”的整体印象。

狂欢底下的硬指标

刷完几百条评论,你会发现一个核心反差:海报上全是虚词,评论里全是实词。虚词是“最强”“革命”“颠覆”,实词是“显存”“权重”“推理速度”“量化”。那些天天跑模型的人,根本不在乎slogan押不押韵,他们只在乎能不能在自己那台旧电脑上跑出效果。

有评论感慨:“我们真幸运。”就这么三个字,没有感叹号,没有表情包,但能读出一种被填饱的满足感。因为过去一周,他们同时得到了DeepSeek的新模型、Minimax的轻量级视频生成器、Qwen的回归预告,还有一堆即将放出的开源权重。这些东西,每一件都是实打实的工具,而不是海报上的艺术字。

但幸运的另一面是选择疲劳。当八个模型同时号称“同尺寸最强”,你该下哪个?评论区给出的解决方案很朴素:等第三方评测,等社区量化,等别人先踩坑。这种“延迟信任”机制,就是对抗营销泡沫的免疫系统。它不反驳广告词,但它用行动证明——真正的口碑来自实测,而不是首发海报。

所以那张梗图的真正价值,不在它怎么讽刺,而在它底下那层评论区怎么解毒。如果你只看图,你会以为中国大模型已经疯了;如果你读了评论,你会知道这帮玩家手里确实有硬货,只是硬货被包在了同样的包装纸里。拆开包装,H3是视频界的惊喜,Qwen 3.8是开源社区的盼头,DeepSeek还在守自己的尺寸王座。每一个都有真实的市场位置,只是他们选了同一天喊话,让旁观者误以为他们在抢同一块蛋糕。

营销话术会过时,但能塞进8GB显存的模型永远有人爱。下次再看到“最强”,别信,去搜实测,去查显存要求,去开源社区翻issue。那张海报只告诉你他们想让你知道的,评论区才告诉你他们真正交付了什么。

原文期刊:LocalLLaMA社区观察  发表日期:2026-08-04  原文标题:三天跟牌背后的真实底牌——基于Reddit评论的现场分析  作者单位背景:独立开源生态观察组