就在DeepSeek把免费模型下架的同一天,一头代号“牛”的神秘模型突然上线,免费、无限量、还能看图看视频!
2026年8月21日,大模型圈出了件怪事。DeepSeek刚把V4 Flash免费版从OpenCode Zen平台撤掉,同一天,DeepSeek官方正式上线了多模态视觉理解模型V4-Flash-Vision-Exp的API。按理说,这是个好消息。但就在所有人都盯着DeepSeek的视觉模型时,OpenRouter上悄无声息地冒出了一个叫“Ox Alpha”的匿名模型。
名字就很搞事情——“Ox”翻译过来就是“牛”,正好撞上最近全网疯传的“Ox is coming,牛来”的热梗。免费、100万Token上下文、支持文本图像视频输入、每日处理能力号称100万亿Token。而且,OpenRouter说这不是他们自己做的,背后是谁,不说。
这就怪了。
一边是DeepSeek把免费的东西收回去、开始收费。另一边是一个不知名的“第三方”突然扔出一个免费且功能更强的多模态模型。更巧的是,同一天DeepSeek自己的视觉模型API刚上线。于是全网开始疯狂猜测:Ox Alpha,是不是就是DeepSeek那个新视觉模型换了个马甲?
但事情没那么简单。
为什么大家都怀疑Ox Alpha就是DeepSeek?
第一个线索来自OpenRouter的模型列表。Ox Alpha的完整标识是“stealth/ox-alpha”。而DeepSeek在2026年3月发布V4模型时,用的匿名代号叫“Hunter Alpha”。同一个平台,同一个“Alpha”后缀的匿名测试套路。小米的MiMo-V2-Pro当初也是先在OpenRouter上以“Hunter Alpha”的名义匿名测试。这个模式太眼熟了——先匿名上线测流量、测负载,测完了再正式发布。
第二个线索是时间点。DeepSeek V4 Flash免费版在Zen平台下架,几乎和Ox Alpha上线是前后脚的事。一个收回去,一个放出来,无缝衔接。有网友直接说:“上午用着用着就没了”。然后Ox Alpha就来了。
第三个线索是功能定位。Ox Alpha的介绍写着“面向高效编程、长时间Agent任务和真实生产环境”,“支持文本、图像和视频输入”。而DeepSeek V4-Flash-Vision-Exp的官方描述是“多模态视觉理解模型”,“在纯文本能力上匹配DeepSeek-V4-Flash,在多模态Agent基准上大幅超越V4-Flash”。定位几乎重叠——都是编程Agent方向,都是多模态,都是长上下文。
但等等。如果Ox Alpha就是DeepSeek的新模型,DeepSeek为什么要匿名?他们刚刚正式发布了Vision版API,完全没必要藏着掖着。而且DeepSeek的V4 Flash Vision是实验模型,官方文档写得清清楚楚。Ox Alpha却自称是“推理模型”。这两个标签放在一起,味道不太对。
技术测试指向了另一个方向
有网友做了个很硬核的测试。他们挑了10款不同的大模型,用11项词元分词器探针去测。结果发现,Ox Alpha在全部11项指标上和智谱GLM完全一致。而其他厂商的模型,匹配度最高不超过4项。
举个具体的例子:在数字探针测试中,DeepSeek消耗了98个Token,但Ox Alpha和GLM都精准地消耗了29个Token。这个差距不是“差不多”,是一模一样。
再看API参数配置。OpenRouter会公开每个模型端点支持的参数。GLM-5.3和Ox Alpha目前拥有一套完全相同且明显收紧的参数接口,而之前版本的GLM根本没有用这套配置。更关键的是,GLM-5.3这套新参数配置是在Ox Alpha出现前两天才上线的。然后Ox Alpha直接照搬了。
知识截止范围也一样。测试显示,两款模型都知道Claude Opus 4.5和GLM-4.6的相关信息,知识范围大致延伸到2025年11月。
Tokenizer一致、参数配置一致、知识截止一致——这已经不是巧合能解释的了。
那Ox Alpha到底是不是GLM?GLM-5.3是纯文本模型,没有视觉能力。而Ox Alpha支持图像和视频输入。智谱创始人唐杰几个月前说过,多模态模式即将上线。所以业内推测,Ox Alpha很可能是智谱尚未正式发布的下一代多模态模型,正在做早期高并发压力测试。
但问题又来了。智谱在8月14日刚刚发布了GLM-5.3,参数规模7530亿,在多个基准测试中拿了开源第一。如果Ox Alpha是GLM的下一代多模态版本,那这个迭代速度是不是太快了点?GLM-5.3才发布一周,下一代就匿名上线了?
“匿名测试”这门生意,早就不是秘密了
其实匿名测试大模型,在圈子里早就不是新鲜事。OpenRouter上隔三差五就会冒出一些没有署名的模型。小米的MiMo-V2-Pro当初就是先在OpenRouter上以“Hunter Alpha”的名义匿名测试,测试完了才正式承认。DeepSeek的V4模型,最早也是以“Hunter Alpha”的名字上线的。所以“Ox Alpha”这个命名方式,本身就带着浓浓的“老演员”味道——Alpha后缀几乎成了匿名测试的标配。
那为什么要匿名测试?很简单。一个新模型上线,你不知道并发能扛多少,不知道真实用户怎么用,不知道会不会出什么奇怪的安全漏洞。直接挂上自家招牌万一崩了,面子挂不住。匿名上线,崩了就崩了,没人知道是谁家的。等测稳定了,再正式发布,又是一条好汉。
所以Ox Alpha匿名这件事本身并不奇怪。奇怪的是它的免费额度——每日100万亿Token。这个数字意味着什么?意味着背后得有上万张GPU在跑。DeepSeek刚刚因为算力成本压力大幅涨价,智谱却有能力免费供应100万亿Token/天?这就很值得玩味了。
DeepSeek那边,到底发生了什么?
先捋一下DeepSeek的时间线。
2026年4月,V4预览版发布,推出Pro和Flash双线,限时2.5折。Flash版几乎是免费的,吸引了大批开发者。
2026年6月30日,引入峰谷定价。
2026年8月17日,新价格正式生效。V4 Pro峰时缓存命中单价涨幅高达12.14倍,输出单价从0.87美元涨到3.96美元。V4 Flash峰时输出也从0.28美元涨到1.32美元,涨幅4.71倍。国内价格方面,V4 Flash峰时输出从每百万Token 2元涨到9元。
2026年8月20日左右,OpenCode Zen平台上的deepseek-v4-flash-free被下架。
2026年8月21日,DeepSeek V4-Flash-Vision-Exp正式上线API。
这一连串动作的逻辑很清晰:免费阶段结束了,该收费收费,该上新上新。DeepSeek从一开始就没打算永远免费——先用低价甚至免费吸引用户、积累数据、打响品牌,等用户习惯了、依赖了,再慢慢把价格拉回来。这套打法在互联网行业太常见了。
但Ox Alpha的出现,打乱了这套叙事的节奏。
如果Ox Alpha不是DeepSeek,那它是谁?
目前全网猜测集中在两家:智谱和小米。
支持智谱的证据刚才说了——Tokenizer测试、参数配置、知识截止,三重匹配。而且智谱确实有多模态的底子,4月份就发布了GLM-5V-Turbo,一个原生多模态Coding基座模型。智谱创始人唐杰也说过多模态模式即将上线。
支持小米的证据来自历史套路。小米的MiMo-V2-Pro当初就是以“Hunter Alpha”的名字在OpenRouter上匿名测试的。小米CFO林世辉最近也透露过,即将推出新的MiMo模型。而且就在8月21日同一天,小米MiMo-V3-Pro的跑分截图在网上泄露了——SWE-Bench Pro得分72.8,高于GLM 5.3的67.9分。时间点太巧了。
但小米的MiMo-V3-Pro目前还没有任何官方确认。泄露的跑分截图是否真实,也不清楚。而且小米之前的多模态能力积累,似乎不如智谱那么深。
还有一种可能:Ox Alpha根本不是这两家中的任何一家。OpenRouter只说它是“第三方模型提供商”,没说是中国的。有人猜是Google Gemini的变体,有人猜是SpaceXAI的Grok。但基于Tokenizer的测试结果——和GLM完全一致——基本排除了海外模型的可能性。Tokenizer这种东西是模型架构最底层的设计,很难被“模仿”到完全一致的程度。
一个无法回避的矛盾
如果Ox Alpha是智谱的模型,那智谱为什么要选在DeepSeek涨价和下架的同一个时间点放出来?是巧合,还是故意的?
如果是巧合,那这巧合也太巧了点。DeepSeek刚把免费饭桌掀了,智谱就在隔壁支了个更大的免费摊子——100万Token上下文、多模态、还号称每日100万亿Token的处理能力。这不就是在抢DeepSeek流失的用户吗?
但如果Ox Alpha是DeepSeek自己的模型——比如是他们那个新视觉模型的匿名测试版——那为什么要搞这么一出“左右互搏”?一边把免费版下架、涨价,一边又匿名上线一个免费的多模态模型?这说不通。DeepSeek没有理由在同一时间做两件方向完全相反的事。
除非——Ox Alpha根本不是“新模型”,而是一个早就计划好的、和DeepSeek完全无关的东西,只是恰好撞上了这个时间窗口。
但“恰好”这个词,在分析哲学里是最值得警惕的。语言的表面意思是“巧合”,但语境里的真实意图往往是“有意为之”。
那个没人注意的细节
Ox Alpha的OpenRouter页面上有一行小字:“Prompts and completions for this model are retained by the provider and are not used for training”——“提示和输出会被提供商保留,但不会用于训练”。
这句话本身没什么特别的,很多模型都有类似的隐私声明。但有意思的是,智谱GLM-5.3的API条款里也有几乎一模一样的表述。而DeepSeek V4 Flash的条款里,没有这句话。
一个微小的文本差异,可能在暗示着完全不同的数据策略和商业逻辑。
更值得注意的是,Ox Alpha目前只提供一周的免费访问。一周之后呢?是收费,还是继续免费,还是直接下线?没人知道。OpenRouter的页面上没有写。Ox Alpha的运营方也没有任何公告。
一个号称每日能处理100万亿Token的模型,只免费开放一周。这听起来不像是在“做产品”,更像是在“做实验”——测并发、测负载、测真实场景下的表现。一周时间,足够收集到海量的真实用户数据和行为模式。然后呢?模型下线,数据带走,优化完再以正式版本发布。
这跟DeepSeek当初做“Hunter Alpha”匿名测试的套路一模一样。也跟小米做“Hunter Alpha”测试MiMo-V2-Pro的套路一模一样。
所以Ox Alpha到底是谁家的?Tokenizer指向智谱,历史套路指向小米,时间点指向DeepSeek。三方各执一词,谁都没有铁证。
但有一个事实是确定的:2026年8月21日这一天,DeepSeek的多模态视觉模型正式上线了。同一天,一个能力更强、完全免费、且身份不明的多模态模型也上线了。两个模型在同一天出现,一个光明正大挂着名字,一个匿名潜伏。
谁在明处,谁在暗处?谁在测试,谁在被测试?
这个问题,一周之后也许会有答案。也许没有。