Opus 5暴打Fable 5:在计算生物学和网络安全领域直接封神

一群生物黑客用Opus 5挖出系统漏洞时,Fable 5还在安全护栏里写诗呢,这不打脸吗?

Anthropic偷偷发布了Claude Opus 5,在计算生物学和网络安全领域直接封神。

Fable 5虽然顶着“前沿模型”的光环,但被安全锁焊死了,碰到生物和网络高风险问题直接装死。Mythos 5倒是解除了限制,可惜只对政府和顶级合作伙伴开门。Opus 5刚好卡在中间,防御性网络漏洞挖掘随便搞,系统生物学短中期任务猛得一批,工具加持下Humanity's Last Exam拿下64.7%,智能体搜索更是干到90.8%的BrowseComp得分。但别高兴太早,这货在长时间自主任务里会陷入无限自我验证死循环,像个卡带的复读机。

三个模型摆你面前选哪个

Fable 5是那个被老师盯死的优等生。它能力确实强,参数规模据说冲到10万亿,知识储备吊打全场。但Anthropic给它装了双重锁,生物设计、网络攻击推演这些高危领域,你刚开口它就甩你一脸安全协议。评论区有人吐槽,问个网络安全问题直接被重定向到阉割版模型,气得想砸电脑。

Mythos 5是开了外挂的隐藏角色。所有限制全部解除,能跑24小时自主生物设计任务,Opus 5卡死的长周期规划它轻松搞定。但问题来了,这玩意不对外卖,只有政府机构和Anthropic认证的顶级合作伙伴能摸到。普通研究员和生物黑客只能眼巴巴看着,像橱窗里的限量跑车。

Opus 5是那个被故意调低智商但放你进门的实用派。Anthropic在训练时特意没给它喂Fable 5用的那套网络安全数据集,等于主动砍了一截能力。但代价换来的是可用性,你能直接上手干防御性漏洞挖掘,系统生物学假设生成跑得飞起。评论区有个搞分子生物的老哥说,他从Perplexity到OpenAI再到Gemini 2.5 Pro试了个遍,只有Claude去年开始给他的系统生物学研究给出靠谱输出。

参数大战背后的算账游戏

马斯克在社交媒体上嘴瓢泄露过,Grok是0.5万亿参数,Sonnet大概1万亿,Opus直接飙到5万亿。Fable和Mythos据推测是10万亿级别,这个数字靠推理成本反推出来的。参数越多模型越聪明,但推理成本也水涨船高。Opus 5跑一趟任务的成本只有前沿梯队的一半,这对预算有限的研究团队来说差的是真金白银。

但参数不是唯一指标。Opus 5在智能体搜索上干到90.8%,Fable 5虽然知识更广但被安全策略绑住手脚。有个评论说得在理,要把"能力更强"和"限制更少"分开看。对普通码农来说,Sonnet 4.8和5.5已经够用了,模型迭代就像iPhone换芯片,日常使用感知不强。但搞计算生物和网络安全的,差一个版本就是天上地下。

评论区吵翻了天。一派觉得参数为王,Fable 10万亿参数吊打Opus 5的5万亿,知识覆盖面根本不在一个量级。另一派直接开怼,说没有任何闭源模型会公布真实参数,马斯克那嘴炮能信?还有人翻出推理成本分析,指出10万亿参数的推理开销根本不是普通实验室能扛的。

安全护栏到底是保护还是枷锁

Anthropic这波操作精得很。他们把Opus 5在网络安全能力上故意训练得"笨"一点,避免触发监管红线。同时又留了后门,防御性漏洞挖掘这种合规场景给你放开。这相当于在钢丝上跳舞,既不得罪监管机构,又把真家伙递到研究员手里。

评论区有个高赞回复点破了本质。假设给你一个零安全护栏的超级模型,能设计药物也能设计生物武器。这玩意落到你手里爽不爽?当然爽。但同一个模型如果被恶意分子拿到,分分钟搞出下一个大流行级别的生化危机。硬币有两面,扔出正面的人爽了,扔出反面的人就惨了。所以大模型公司死守安全底线,不是他们不想给,是真不敢给。

但有个评论直接开喷说这是套路。Anthropic故意把Opus 5的能力卡在监管红线下面,等于绕过美国AI法规。Fable 5被锁死是给监管看的,Opus 5放出来是给用户用的。你要问高风险的生物网络交叉问题,系统就把你踢回更蠢的模型。这哪是安全设计,分明是合规表演。

真实战场上的Opus 5到底能不能打

生物信息学研究员是最大受益群体。Opus 5在短中期生物设计任务上表现出奇地好,配合网络搜索和外部工具做假设生成,输出质量吊打其他模型。有人专门在分子生物学板块发了数据完整性指南,专门讲怎么用Claude辅助计算分析。评论区一堆人跟帖说终于找到能用的工具了。

网络安全方向走防御路线的赚到了。漏洞挖掘这块Opus 5明确放开,白帽黑客可以合法用它扫描代码找后门。但想搞攻击推演和自动化渗透测试?抱歉,系统会直接拦截。有个评论吐槽说他想测试一个防御策略,结果被重定向到Sonnet级别模型,给出的答案浅得像儿童读物。

长周期任务千万别碰。系统卡上写得明明白白,Opus 5在长时间生物设计任务里会陷入无限自我验证循环。你让它跑24小时自主规划,它能把自己卡死在验证步骤里出不来。这时候只有Mythos 5能救场,但你又搞不到。所以最实用的打法是人机协作,你来当方向盘,Opus 5当发动机,随时打断它的死循环。

评论区给我整明白了

第一条热评直接灵魂拷问:"24小时自主战役规划这需求真实存在吗?"底下秒回一个字:"有。"简短得像狙击枪。然后楼主追了条长回复把格局打开了,说免费系统不可能毫无限制地释放,安全不是口号是刚需。他还补了一刀,说自己从去年开始试了Perplexity、OpenAI、Gemini 2.5 Pro,只有Claude在他的系统生物学领域给出能用的结果。这段回复下面又炸出一堆做生物AI的人报团取暖。

有人跳出来抬杠说别吵了,Opus和Fable对普通用户来说就是Sonnet的年更版。话音刚落就被怼回去,搞化学的人现身说法,说Sonnet连基本物质属性都经常搞错,同一个离谱错误反复出现,逼得他把纠正内容写进项目提示词里。他想要更好的模型,不是像某些人那样躺着说够用了。

还有人翻出推理成本反推参数规模,说Opus是5万亿,Fable是10万亿。立刻有人怼闭源模型不公布参数,这些都是瞎猜。两边吵得不可开交的时候,有人幽幽来了一句:"嘘,别嚷嚷,小心政府把Opus也禁了。"然后底下跟了个经典回复:"Ok boomer。"整个评论区画风瞬间从技术辩论变成大型玩梗现场。

你到底该怎么选

如果你搞计算生物学短中期任务,Opus 5闭眼入。假设生成、数据挖掘、文献分析这堆活儿它干得比谁都漂亮。成本还只要前沿模型的一半,省下来的经费够再跑十个实验。但记住别让它独立跑长周期规划,你会收获一个无限转圈的AI智障。

如果你做防御性网络安全,Opus 5就是为你量身定做的。漏洞挖掘权限明确开放,配合100万token上下文窗口,一整份代码库直接塞进去让它扫。但别碰攻击推演和自动化渗透,那是禁区。

如果你是普通开发者或者码农,说实话Sonnet级别已经够你折腾了。评论区有人说得实在,模型迭代到现在,"屎一样的模型"时代已经过去了。别被参数数字冲昏头,先想清楚你要解决什么问题。Opus 5再强也不是万能钥匙,Fable 5再强你也用不上。挑能用的,别挑能吹的。

最后补一句暴论。评论区有人暗示Anthropic这波操作是在钻监管空子,把本该锁死的能力通过"降智处理"合规释放。如果这是真的,那Opus 5就是个披着羊皮的狼。表面参数砍了一截,内核里该有的推理能力一点没少。这种"主动变笨但能出门"的策略,比硬刚监管高明一百倍。所以你手里的Opus 5到底是被阉割的残次品,还是故意扮猪吃老虎的真大佬?自己品吧。



这场模型暗战打到最后赢家是会用工具的人。别被参数带偏,别被营销洗脑。Opus 5能干啥不能干啥系统卡写得明明白白,自己对照需求选就行。管你Fable还是Mythos,能让我跑通实验流程的才是好模型。剩下的都是营销话术,听听就得了。别跟风,别上头,先把手头的问题解决了再说。