Kimi K3定价3美元碾压Claude Fable 5,美国AI政策搬石头砸自己脚


Kimi K3以3美元/百万输入token的价格杀进市场,Claude Fable 5却要收你10美元——这差价够你请全组喝一个月奶茶,可美国政府还在忙着给自家模型上锁,你说这政策是防贼还是防自己人?

2026年7月,中国AI公司月之暗面(Moonshot AI)发布Kimi K3,这款拥有2.8万亿参数的开放权重模型直接对标美国顶尖闭源系统。与此同时,Claude Fable 5因成本过高被迫从20美元订阅套餐中下架,OpenAI的GPT-5.6虽突破政府限制却历经波折。开源模型价格仅为闭源模型的三分之一,性能却旗鼓相当,美国AI政策在开放与管制之间的摇摆正让本土用户沦为最大输家。

本文深度拆解Kimi K3定价策略、Claude订阅陷阱、GLM 5.2安全基准突破,以及GPT-5.6政府审查事件,揭示AI产业格局剧变下的用户选择逻辑与政策悖论。

月之暗面甩出价格核弹

Kimi K3的API定价让硅谷的咖啡都变苦了。

输入token每百万只收3美元,输出token每百万15美元。这个数字放在2026年的AI市场上,相当于用经济舱的价格买到了头等舱的座位。Claude Fable 5的定价是输入10美元、输出50美元每百万token,整整贵了3到5倍。更离谱的是订阅端——Kimi的付费套餐从19美元起步,39美元的编程档位包办的额度,Claude在同价位上连影子都摸不着。

一位开发者在日常编码工作中把Kimi K3和Claude并排跑了两周,结论是根本分不清谁是谁。同样的任务,同样的输出质量,连消耗的token数量都几乎一样。他原本以为开放模型会更 sloppy( sloppy 指 sloppy,这里指输出质量差、容易出错)或者需要更多token才能搞定,结果两样都没发生。

月之暗面这家公司2023年才成立,创始人杨植麟从清华毕业,之前在Google和Meta做过研究。2024年靠Kimi平台的长文本分析功能攒下第一批用户,2025年DeepSeek的R1模型横空出世,把Kimi从国内第三打到第七。Moonshot的应对策略简单粗暴——全面转向开源。K2、K2.5、K2.6一路开源过来,K3是这套策略的集大成者。2.8万亿参数,1百万token上下文窗口,多模态理解,7月16日发布,7月27日开放权重下载。

这里要解释一个术语:开放权重(Open-weight)。它跟严格意义上的开源(Open Source)有区别。开放权重意味着你可以下载模型的训练好的参数,自己部署、微调、商用,但训练数据和训练代码不公开。对大多数开发者来说,这已经够用了。K3用的是修改版MIT许可证,商用基本无限制。

K3的架构也挺有意思。Mixture-of-Experts(MoE,混合专家模型),896个专家,每次只激活16个。总参数2.8万亿,实际每轮推理只动用一小部分,所以延迟没有想象中那么夸张。上下文窗口拉到1百万token,靠的是Kimi Delta Attention(KDA)和Attention Residuals(AttnRes)技术,这些在Kimi-Linear模型里已经公开验证过。

价格方面,K3虽然比自家前代K2.6(0.95/4美元)贵了不少,但跟美国前沿模型一比依然是白菜价。缓存命中输入token只要0.3美元每百万,这对编码场景特别友好——代码仓库的上下文可以重复利用,实际成本还能再降。

Claude的订阅套餐暗藏机关

Anthropic的Claude Fable 5在2026年6月9日发布时,风头一时无两。SWE-bench Pro得分80.3%,比Opus 4.8的69.2%高出一大截。定价也\"对得起\"这份性能——输入10美元、输出50美元每百万token,是Opus 4.8的两倍。

但问题出在订阅端。Fable 5在Pro套餐(20美元/月)里只免费包含了短短两周,6月23日起就转成了按量计费。Anthropic的官方说法是\"等容量允许时再恢复套餐内包含\",但没说具体日期。更坑的是,Fable 5有个安全分类器(Safety Classifier),遇到网络安全、生物化学、蒸馏攻击等敏感请求时,会自动fallback(回退)到Opus 4.8。你付的是Fable的钱,用的是Opus的脑子,这找谁说理去?

这还没完。Claude的套餐额度设计得相当紧巴。正常一天的agent工作流(Agentic Workflow,指AI自主执行多步骤任务的流程),可能还没到午饭就把当周额度啃光了。额度一用完,模型自动降级到Sonnet或者更便宜的版本。Anthropic在6月15日还提过一个Agent SDK信用点的方案,想对自动化调用额外收费,结果在生效前被撤回了——但信号已经很明显:他们正在到处找地方插计费表。

对比之下,Kimi的套餐设计就厚道多了。19美元起步,39美元编程档,没有隐藏的fallback机制,没有突然消失的旗舰模型。你用K3就是K3,不会半夜偷偷变成K2.6。

这里有个认知反差特别值得玩味。Anthropic一直打着AI安全的旗号,结果他们的\"安全\"措施第一条就是让你付更多的钱才能用完整的模型。Fable 5的Mythos版本(无安全分类器的原始版本)只给Project Glasswing计划里的审核过的合作伙伴用,普通人连门朝哪开都不知道。月之暗面呢?直接把2.8万亿参数的模型权重放到网上,谁爱下谁下,谁爱改谁改。你说这俩公司,到底谁更\"开放\"?

美国政府给自家模型戴上手铐

2026年6月2日,特朗普政府签了一份行政令,要求前沿AI模型在发布前提交政府进行网络安全评估,审查期最长30天。6月26日,OpenAI发布GPT-5.6家族——Sol(旗舰)、Terra(中端)、Luna(快速版),但Sol只给大约20个政府审核过的合作伙伴用,普通用户、ChatGPT订阅者、一般开发者全部锁在外面。

这是美国历史上第一次,最顶尖的AI模型发布时不是面向公众,而是面向一张政府批准的名单。OpenAI自己的说法是\"政府要求的\",CEO Sam Altman之前已经向官员汇报过GPT-5.6的能力。商务部长Howard Lutnick想确保政府在模型上线前有机会审查和测试。OpenAI表态说这个审查流程不该成为长期默认,但身体很诚实——他们照做了。

Anthropic的Fable 5更惨。6月9日发布,6月12日就被美国商务部的出口管制令给掐了,全球下线18天。7月1日恢复上线时,加了一个新的安全分类器,号称能拦截99%以上的越狱尝试,敏感请求自动回退到Opus 4.8。这个\"升级版\"Fable 5拒绝执行整个类别的工作——网络安全、生物化学、模型蒸馏,碰就弹回。

讽刺的是,这些被美国自己人管得死死的模型,在真实工作能力上反而不如不受约束的开源替代品。Semgrep在2026年6月跑了一个网络安全漏洞检测基准测试,测的是IDOR(Insecure Direct Object Reference,不安全直接对象引用,一种常见的访问控制漏洞)。GLM 5.2在裸提示词、无任何辅助框架的情况下,F1得分39%,Claude Code(基于Opus 4.6)只有32%,Opus 4.8/4.7更是只有28%。

GLM 5.2是智谱AI(Z.ai)2026年6月13日发布的模型,MIT许可证,商用无限制,权重直接挂在Hugging Face上。总参数约7500亿,每次激活约400亿,上下文窗口1百万token。定价约为同类前沿模型的六分之一,每发现一个安全漏洞成本约0.17美元。它在SWE-bench Pro上得分62.1,比GPT-5.5的58.6还高。

Semgrep的测试方法很实在:不给模型任何特殊脚手架(Scaffolding,指额外的工具链或辅助框架),就扔一段代码和一个提示词,看它能挖出多少漏洞。GLM 5.2赢了,赢得干脆利落。美国政府费尽心机给自家模型加的安全锁,结果锁住的只是美国用户的访问权限,开源模型该干嘛干嘛,一点没耽误。

OpenAI的GPT-5.6在7月9日终于解除限制,全面开放。Sol可以放进20美元的ChatGPT Plus套餐里,Terra和Luna也各就各位。但这段政府审查的经历已经留下了痕迹——OpenAI是第一家被迫走这道程序的,Anthropic是第一家被掐断的,而月之暗面、智谱AI这些中国公司,根本不在美国政府的管辖范围内,他们的模型全球可下、无锁可用。

开源模型撕开管制铁幕

GLM 5.2的MIT许可证是一记响亮的耳光。这个许可证的意思是:你可以随便下载、随便改、随便商用,不用问任何人。Claude Fable 5的API定价是输入10美元、输出50美元每百万token,GLM 5.2的同等能力只收你六分之一的钱。更关键的是,GLM 5.2不挑活——网络安全扫描、代码审计、漏洞挖掘,你让它干嘛它干嘛,没有自动回退,没有\"这个请求太敏感我不能做\"。

这揭示了一个残酷的现实:美国AI政策的逻辑链条从头到尾都是断的。政府担心前沿模型被坏人利用,所以给美国公司的模型加锁。但开源模型不受这个锁约束,中国公司发布的开源模型美国政府管不着,全球开发者该下载下载、该部署部署。最后的结果是,美国用户花更多的钱,用更受限的模型,而世界其他地方的人用更便宜、更自由的替代品。

GPT-5.6的遭遇更能说明问题。OpenAI被政府审查了两周,最后放行了,但这段经历已经让市场看清楚了——美国最前沿的AI发布,现在要看政府脸色。Anthropic的Fable 5被掐了18天,回来时已是个阉割版。 Meanwhile(与此同时),Kimi K3和GLM 5.2安安静静地发布,没有任何政府干预,全球开发者一视同仁。

这里有个特别冷的笑点。美国政府给AI模型加的出口管制,本意是防止技术外流,结果管住的只是美国公司。中国公司的模型本来就全球开放,管制令连边都擦不着。Semgrep的测试报告里写得明白:受限制的模型拒绝执行任务,开源模型直接干活。这管制到底防的是谁?

更深层的问题在于,这种管制正在扭曲美国AI产业的竞争力。Anthropic因为安全审查和成本压力,不得不把Fable 5从订阅套餐里下架,换成按量计费。OpenAI虽然最终把GPT-5.6 Sol放进了20美元套餐,但审查过程消耗的时间和资源都是真金白银。月之暗面和智谱AI没有这些负担,他们的定价策略可以更大胆,发布节奏可以更快。

美国AI产业正在重蹈汽车业覆辙

作者Stephen Bochinski在文章结尾做了一个类比,这个类比值得单独拎出来细品。

他说美国政府接下来很可能会用补贴、救助、保护性关税这些工具来扶持本土AI产业。这套 playbook(playbook 原指战术手册,这里指固定套路、惯用策略)在汽车业已经演了几十年——美国车企靠政策保护在国内卖皮卡,出了国门基本没人买。结果是美国消费者花高价买本土车,质量和性价比都不如国际竞品。

AI领域正在往同一个方向滑。Public-private partnerships(公私合作)扶持的本土模型,只在美国国内用,国际上打不过开源替代品。美国成了唯一一个花高价买低质模型的国家,而且这些模型还跟特朗普政府深度绑定,既非最高质量,也非最低价格。

这个预言的冷峻之处在于,它不需要等几十年才能验证。Kimi K3和GLM 5.2已经摆在桌上,价格透明,权重可下,能力经测。美国开发者现在就可以切过去,省下的钱够养一个团队。Anthropic和OpenAI的客户忠诚度,在真金白银面前能撑多久?

GPT-5.6最终突破了政府限制,7月9日全面开放,Sol进了20美元套餐。OpenAI好歹有这份\"runway\"(runway 原指跑道,这里指回旋余地、操作空间)——他们撑过了审查期,把旗舰模型保住了。Anthropic显然没这么幸运,Fable 5的订阅套餐至今没恢复,按量计费的模式把中小开发者往外推。

月之暗面的估值已经从200亿涨到315亿美元,年化经常性收入(ARR)在6月中旬突破3亿美元,海外付费用户和API收入都涨了400%。这些数字说明市场已经用钱包投了票。开源、低价、无锁,这三张牌打出来,闭源模型的护城河正在以肉眼可见的速度干涸。

美国AI政策的制定者现在面临一个选择题:继续加锁,把本土用户逼向开源替代品;还是放松管制,让美国模型在价格和自由度上跟开源竞争。从汽车业的历史来看,他们大概率会选第三条路——既不加锁也不放松,而是撒钱补贴,养出一批只能靠政策存活的\"温室模型\"。

到那时,美国开发者就会发现自己活成了段子里的主角:花着最贵的钱,用着最阉割的模型,看着中国开源模型在全球跑马拉松,自己还在跟政府的审查表格较劲。这画面,想想都觉得提神。

Kimi K3的定价、GLM 5.2的许可证、GPT-5.6的审查经历,三件事拼在一起,画出了一张清晰的产业地图。开源模型正在从边缘走向中心,政府管制正在从保护变成束缚,用户选择正在从品牌忠诚转向成本效益。这张地图上没有标注\"美国例外论\"的位置——在代码和token的世界里,便宜、自由、好用,永远比国籍更有说服力。

Stephen Bochinski说他已经找不到继续给Claude付钱的理由了。这句话放在2026年7月,可能会让Anthropic的PR团队睡不着觉。但市场不会睡觉,开发者不会睡觉,月之暗面和智谱AI的发布节奏更不会睡觉。美国AI产业的警钟已经响了,问题是——还有人听得见吗?