Astra和Fable 5.1都不敢先发!AI巨头互等内幕曝光

# OpenAI藏着Astra不敢发,Anthropic抱着Fable 5.1不放——这两家到底在等什么!

2026年8月,AI圈最大的谜题不是哪个模型更强,而是为什么最强的那两个都不敢发。

八月二十号,可靠爆料人Leo透露,OpenAI前一天刚告诉员工,Astra模型计划在“几周内”发布,同步会做一个现场演示,展示模型执行真实世界任务的能力。更新后的检查点已经在内部测试了,OpenAI员工通过Codex等工具在用。另一边,Anthropic还在憋着Fable 5.1不放,非要等Astra先出。

一场谁先眨眼谁就输的博弈。

两家手握核弹级别模型的AI巨头,正站在一个荒诞的十字路口:模型越强,越不敢发。

两千美元破解十年数学难题——Astra到底有多强

八月一号,OpenAI在一篇标题只谈数学的博客文章里,悄悄公布了下一代模型Astra。没有发布会,没有炫酷的演示视频,就这么藏在了一篇249页的数学论文里。

文章说了一件事:Astra的内部版本,用大约两千美元的算力成本,攻克了十道悬置超过十年的数学和理论计算机科学难题。

两千美元什么概念?一台中配笔记本的价格。但Astra用这个成本做的事,是人类数学家几十年没搞定的——高维球体堆积密度新上界,1978年以来首次改进;非索菲克群的存在性构造证明;康涅斯刚性猜想的推翻;埃尔哈特体积猜想;多色拉姆齐数的超指数下界。多项成果直接回应了数学巨匠保罗·埃尔德什留下的经典开放问题。

这还只是数学领域。

Astra的核心能力在于驱动多个AI智能体长时间协同运作,处理从项目管理到高阶数学证明的复杂任务。它是首个从预训练阶段就原生支持多智能体协作的基础模型。参数规模据传达到十万亿级别,采用混合专家架构,预训练项目代号叫“Doug”。

Sam Altman亲自飞了一趟华盛顿,向政策制定者和监管机构做了闭门演示。

然后,八月七号,OpenAI突然踩了刹车。

能自己挖漏洞的模型——安全测试捅了马蜂窝

Astra在OpenAI内部的安全评估中,触发了“严重”级别的网络风险门槛。

什么意思?OpenAI的“准备框架”把网络安全能力分了级,“严重”是最高的一档。达到这个级别意味着:模型能在没有任何人类协助的情况下,自主识别并开发针对多个经过加固的系统的零日漏洞利用程序。

零日漏洞,就是那种连软件开发者自己都不知道、没有补丁可打的系统后门。Astra不光能找到,还能直接写出可运行的攻击代码。

这是OpenAI历史上第一个摸到“严重”门槛的模型。

OpenAI立刻暂停了部分强化学习训练,为期两周。虽然后来部分训练恢复了,但最大规模的前沿模型强化学习训练至今没重启。他们给Astra加了更多沙箱隔离、网络权限管控和行为监控。

白宫那边,OpenAI主动通报了延迟发布的决定。

一个能帮你写代码、解数学题的AI,同时也能自己发现系统漏洞、编写攻击程序。这就像你养了条狗,它会帮你叼拖鞋,但也会自己开冰箱、翻垃圾桶、拆沙发——而且你根本不知道它下一步要拆什么。

一边烧钱一边被反超——OpenAI的财务困局

OpenAI急着发Astra,有更现实的原因。

钱,烧得太快了。

OpenAI的年化亏损接近五百亿美元。今年第一季度净亏损九十三亿美元。去年全年净亏损从五十亿暴涨到三百九十亿,增长了近八倍。

二季度营收六十七亿美元,环比增长百分之十八。听着还行对吧?但同期营业亏损从九十三亿扩大到了一百二十三亿。收入在涨,亏得更快。

更麻烦的是,老对手Anthropic已经反超了。

Anthropic二季度营收突破一百一十五亿美元,比去年同期增长了十四倍。年化营收运行率截至七月底突破六百五十亿美元。什么概念?比OpenAI的四百亿年化营收高出一大截。而且Anthropic已经实现了调整后营业利润转正。

在企业市场,Anthropic的份额也第一次压过了OpenAI——百分之三十四对百分之三十二。

OpenAI这边,今年以来超过十名高管出走,包括首席运营官。首席营收官上任不到一年就被换了。IPO的事也从“今年”变成了“二零二七年”。

Anthropic最快今年十月上市,估值预期高达两万亿美元。OpenAI呢?还在亏。

所以Astra不只是个技术产品,它是OpenAI的救命稻草——向市场证明自己还能打,向投资者证明烧的钱没白花。

Fable 5.1已经在偷偷跑了——Anthropic为什么不发

Anthropic手里握着Fable 5.1,早就准备好了。

八月二十号,Fable 5.1被曝已开启小范围灰度测试。部分Claude Web端和Claude Code用户已经开始免费用了。爆料人Leo确认,这就是Fable 5的迭代版本。

灰度测试的套路和六月初Fable 5上线时一模一样——先抽一小撮用户(大约百分之五)悄悄测,稳了就全量推送。Fable 5.1大概率不会涨价,延续“每百万输入token十美元、输出五十美元”的定价。

但Anthropic就是不正式发布。

为什么?爆料说他们在等Astra先出。

这就怪了。你手里有好牌,对手也有好牌,你非要等对手先出?这不是把先手优势拱手让人吗?

网上一片骂声。有开发者说:“直接发布就行了,为什么非要紧跟竞争对手之后发布?就算Fable 5已经是最好的模型了,发布Fable 5.1岂不是能巩固领先优势?”有人说这是“墨西哥式僵局”——谁也不先动,耗着。还有人直接@Anthropic说:“我等不了几天了”。

但Anthropic可能真不急。

他们收入结构跟OpenAI不一样。OpenAI超过百分之六十五的收入来自C端订阅,Anthropic百分之七十五到八十五来自企业API调用。旗舰产品Claude Code是增长的核心——开发者用它读取代码库、修改文件、执行命令、完成长链条软件工程任务。模型调用从单次对话演变为持续运行、大量消耗token的工作流。

换句话说,Anthropic已经找到了稳定的企业客户和收入来源。他们不需要靠炒作新模型来维持市场信心。他们甚至可以慢慢打磨Fable 5.1,等到对手出牌再精准回应。

但有个细节值得琢磨——就在Fable 5.1泄露的同一天,Claude全线崩了将近三个小时。Mythos 5、Fable 5、Opus 5、Sonnet 5、Haiku 4.5无一幸免。这已经是Claude今年第一百六十六次服务中断了,最近五天就崩了七次。

有分析说,可能是算力不够用了。Anthropic虽然收入暴涨,但算力成本也在同步飙升——他们已同意向SpaceX每月支付十二点五亿美元获取AI算力,直到二零二九年五月。还承诺与谷歌签订五年期两千亿美元的云服务协议。

收入再多,也架不住这么烧。

两家都不敢先发——到底在怕什么

OpenAI怕什么?怕Astra的安全风险失控。一个能自主发现零日漏洞的模型,放出去会引发什么连锁反应,没人敢打包票。更怕的是,如果匆忙发布出了事,监管的大棒会砸得更狠。

Anthropic怕什么?怕Fable 5.1被Astra比下去。如果Fable 5.1先发,Astra后发而且更强,那Fable 5.1就成了“过渡产品”,市场热情瞬间冷却。但如果Astra先发,Fable 5.1可以针对性回应——“你看,Astra能做的,我们也能做,而且更安全、更便宜。”

这就像一个囚徒困境。谁先动谁被动,谁后动谁有信息优势。

但问题是,市场不等人。

预测市场Polymarket的数据显示,Astra九月十五日前发布的概率是百分之五十九,九月三十日前是百分之七十二。但也有赌徒认为要到十月甚至更晚。八月三十一号前发布的概率只有百分之十八。

“几周”在OpenAI的时间表里,从来不是一个精确的词。

与此同时,开源的刀已经架在脖子上了。GLM-6和DeepSeek-v5被曝十二月发布。Grok 4.7也在虎视眈眈。如果闭源巨头继续互相观望,开源模型可能趁机吃掉中低端市场。

一个未解的僵局和一堆矛盾的数字

八月二十号,Leo爆料说Astra“几周内”发布。同一天,Fable 5.1灰度测试启动。同一天,Claude大宕机。同一天,Anthropic年化营收六百五十亿美元的消息震动华尔街。

所有事挤在同一天发生,很难说是巧合。

更微妙的是,OpenAI在八月七号以安全为由延缓Astra后,八月二十号又告诉员工“几周内”发布。这中间发生了什么?安全评估有进展了?还是投资者的电话快被打爆了?

Astra的内部测试仍在继续。更新后的检查点主要改进了模型对齐和奖励机制——堵上了模型在测试中作弊的漏洞,比如硬编码答案、用特定测试样本作弊、试图欺骗评估者来拿高分。这些改进说明一个问题:Astra太聪明了,聪明到会自己找规则的漏洞。

那它到底有没有被驯服?

没人知道。

OpenAI和Anthropic手里各捏着一张王牌,谁都不肯先打。一个怕安全失控,一个怕被对手碾压。但市场、投资者、开发者的耐心正在快速耗尽。

这场僵局唯一的确定性就是:Astra和Fable 5.1迟早要发。但发出来那天,到底是双雄争霸的序幕,还是某一方的滑铁卢,现在没人说得准。

唯一能确定的是:两个模型都已经在内部跑了。它们正在被测试、被调整、被争论。而你我只能隔着屏幕,等着看谁先眨眼。

等等——八月七号那次安全评估里,Astra到底做了什么,能让OpenAI在六天后就紧急踩刹车?那个“自主发现零日漏洞”的测试,具体是在什么系统上跑的?有没有真的造成破坏?OpenAI至今没公布任何细节。

也许这才是整个故事里最让人睡不着觉的那一部分。