涨价信号?取消Claude后用DeepSeek花了1.87刀肝了七天代码


来自Reddit网友帖:你每个月白扔40美金给Claude和ChatGPT,就为了看那个额度条一点点变红?我取消订阅试了七天的DeepSeek V4 Flash 0731,看完账单我直接傻了。

有人花40美金买俩订阅还怕额度烧完,有人花1.87美金连肝七天代码。这差价够买二十杯奶茶,关键那杯奶茶喝完就没了,这1.87美金换来的代码量够你改到下周。评论区吵翻天了——有人说24M输入token连热身都不算,有人说自己一周干穿10亿token。

到底谁在吹牛?谁才是真正的冤大头?先别急着站队,省钱的账要算,踩过的坑也得数清楚,最后还得问问:这帖子本身靠谱吗?


一块八毛七怎么干翻四十块

先别管那些花里胡哨的跑分,直接看钱包。你每个月从信用卡划走40美金给Claude和ChatGPT,图啥?图个心安?觉得贵的就是好的?我原来也这么想。

直到有一天我盯着Claude的额度条,那个紫色进度条以肉眼可见的速度往右跑,我还没写完一个函数呢,它就告诉我“快到头了”。那种感觉就像你刚进网吧开了台机子,屁股还没坐热,屏幕弹窗说余额不足。我受不了了。

然后我干了件事。取消所有订阅。七整天,所有代码活,全甩给DeepSeek V4 Flash 0731的API,不用网页版,就用API硬刚。

结果出来了:七天的总花费,1.87美金。
对,你没看错,不是187,不是18.7,是一块八毛七。

我拿这钱连杯大杯奶茶都买不到,但它养了我整整一周的编码需求。

具体怎么算的?总共吞了大概2400万输入token和600万输出token。关键点在于上下文缓存,这玩意儿才是真正的省钱外挂。缓存命中直接让有效成本砍掉七成。什么意思?就是说你每次问同样的问题或者让AI基于之前聊过的内容继续干活,它不需要重新从头读一遍所有东西,直接从缓存里捞,费用打骨折。

评论区有人说2400万token太少了,自己一天就烧2亿。这就要看你咋定义“工作”了。我的操作模式是交互式的:我读完AI给的代码差异,自己审核,手动微调,再让它走下一步。不是那种甩手不管让AI自己跟自己玩循环的模式。所以我的输入大部分是缓存命中,真正掏钱买的那部分很少。你看,这就是第一个认知反差:你以为省钱就要牺牲工作量,实际上关键不在于你发了多少条消息,而在于你的工作流能不能让上下文缓存替你省钱。

那些一天烧几亿token的人,大概率是让AI自己跟自己对话,搞自动化循环。不同玩法,不同账单,但现实是——哪怕你像我这样交互式干活,1.87美金也够你写一周了。

评论区一堆人晒截图。有人一周烧掉6.8亿token,有人一天就干穿2亿。他们是不是在吹牛?还真不是。

问题出在大家对“编码”这俩字的理解差太远了。好比有人说“我吃了一顿饭”,有人吃的是馒头咸菜,有人吃的是满汉全席,账能一样吗?那些一天烧2亿token的人,干的不是“写一个函数”这种活儿,而是“让AI自己执行自动化循环”:AI写代码,跑测试,报错,自己读报错,自己改,再跑,再报错,再改——整个过程不需要人插手。这玩意叫代理循环,每一圈都在烧token。

我后来翻了自己的日志,两天内总token消耗其实分别是3.7亿和5.4亿。跟评论区那些大佬一个量级。

差别在哪?缓存命中率。我这边缓存命中率98%左右,真正按原价付钱的输入部分只有600多万。也就是说,表面上看我一周用了2400万输入token,但那是我实际付钱的部分,不是总消耗。总消耗量级跟那些吹“一天2亿”的人是一样的。所以别被数字唬住。

那些喊着“24M算个啥”的人,他们要么没搞懂缓存计费规则,要么就是自己真的在干纯手工无缓存的活儿——那你烧钱速度当然快。但话又说回来,就算你一天烧2亿非缓存输入,放在DeepSeek这个价格体系下,也没多少钱。


便宜没好货?这些硬伤够你喝一壶

吹完省钱,该泼冷水了。光讲优点不讲缺点,那跟广告软文有啥区别?

评论区那些老炮儿已经把槽点扒了个底朝天。

第一个让我炸毛的——视觉识别功能在API里是锁死的。官方发了公告说支持视觉了,但我用的API版本就是没有。遇到需要看图的情况怎么办?你只能老老实实把截图里的内容用文字描述一遍喂给模型。一个截图几百个字,手打五分钟,这五分钟够你喝口水冷静一下了。评论区有人自己写了个桌面控制台加视觉模块,但那是折腾,不是标配。如果你日常工作重度依赖截图识别,Flash这个坑能直接把你劝退。

第二个硬伤藏在推理输出里。在某些长对话链中,模型会莫名其妙吐出)Skip这种字符串。不是代码,不是注释,就是纯粹的字符垃圾。出现的频率不高,我一周碰到两三次,但每次看到都要愣一下——这玩意儿是啥?是不是模型内部推理卡壳了?评论区也有人提到模型在长上下文里会忘记代理规则文件里的重要指令,你明明写了“必须用英文输出注释”,它突然给你来段中文。这种不稳定性在关键任务上很要命。更有人发现新版本变得更“固执”,你让改A,它顺手改了B,美其名曰优化,实际上把你测试用例搞挂了。

第三个短板是天花板问题。复杂多文件架构设计,Claude依然碾压。我试过让Flash处理一个跨六个文件的模块重构,它给出的方案能用,但架构层面的取舍明显不如Claude圆滑。Claude会主动问你“你考虑过这个接口的扩展性吗”,Flash更倾向于直接给一个“现在能跑”的版本。对于那种需要全局视角的活,你没法完全依赖Flash。所以原帖作者的结论其实很鸡贼:“留一个订阅对付硬骨头”——这不等于承认了Flash干不了重活吗?省下来的钱,有一部分是拿功能降级换的。


别急着转粉,这帖子本身就有问题

前面两章都是在聊DeepSeek好不好用,现在该聊聊这个帖子本身了。

评论区最高赞的几条全在干一件事——打假。

第一个硬伤,时间线对不上。原帖说“连续七天使用”Flash 0731,但模型版本是上周五才发布的,往前推七天根本没这个版本。有人直接调侃“你忘了提时光机”。这个漏洞被逮住后,整个帖子的可信度直接腰斩。如果连最基本的发布时间都搞错了,那账单数字还能信吗?

第二个争议集中在数字游戏上。原帖说2400万输入token撑了七天,评论区一堆老手跳出来说“我一天就烧2亿”。后来原帖作者补了日志截图,解释说他说的2400万是缓存未命中的实际付费部分,总消耗其实几亿。但这个澄清来得太晚,而且藏在回复里,很多人根本没看到。更尴尬的是,这个“澄清”本身又引出新问题——他一开始为啥不说清楚?是有意制造冲击力,还是自己也没搞明白计费规则?不管是哪种,都让帖子的公信力再掉一截。

第三个质疑最诛心——这帖子本身就是AI写的。有评论直接说“Holy ai post”,有人分析文风“一股Claude味儿”,还有人指出“Here's what actually happened”这种句式是AI生成文本的典型标志。如果连抱怨Claude的帖子都是AI代笔的,那这个实验的真实性还剩多少?更讽刺的是,评论区吵得最凶的那群人,很多自己也在用AI生成回复,整个帖子变成了一场AI互相鉴定对方是不是AI的荒诞剧。

更深层的问题在于社区生态。大量用户认为这种“省钱晒单”帖子是DeepSeek的隐形营销。理由很直接:数据好得不真实,结构太工整像套模板,而且每隔几天就冒出来一个类似帖子。有人警告“这种帖子越多,DeepSeek涨价越快”——因为社交媒体吹捧会导致用户涌入,服务器扛不住就得提价。如果真是营销,那1.87美金的故事就是钓你上钩的饵。如果不是营销,那这帮用户就是在亲手毁掉自己的省钱工具。两种可能性,没有一种让人舒服。

最后,别忘了那些没写进帖子的隐藏成本。上下文缓存虽然省钱,但很多新手根本不知道怎么利用——你得把对话组织成可缓存的模式,避免频繁切换上下文,这本身就是一种额外的脑力成本。某些编码工具对Flash的适配不如Claude顺畅,你省下来的订阅费,可能需要花时间去折腾环境配置。而且API模式下没有图形界面,每次调参都得敲命令行,时间成本也是钱。一块八毛七只是显性账单,隐性成本算进去,实际省下的可能没那么多。


有人靠跑分和Benchmark吹牛,有人靠实际写代码省钱。但这篇帖子告诉我们另一件事——省钱的故事本身也可能是被包装过的。账单可以造假,截图可以伪造,连抱怨Claude的语气都可以用AI生成。下次再看到“一周只花一块八”的帖子,先问问自己:这个实验真的存在吗?还是说,你看到的只是一篇AI写的、关于另一款AI有多便宜的、AI生成的营销文?

四个总标题:是什么?| 取消Claude后我用1.87美金肝了七天代码。有什么用?| 上下文缓存让你的AI账单从40刀直降到5刀以内。哪个领域?| AI编程API价格战里DeepSeek V4 Flash的省钱实战。反常识点?| 省钱帖本身可能是AI写的,一块八毛七的故事也许只是营销陷阱。


原文期刊:Reddit r/DeepSeek / 发表日期:2026年8月6日 / 原文标题:I canceled Claude 7 days with DeepSeek V4 Flash 0731 — the honest cost & quality breakdown / 作者单位背景:Reddit用户Even_Command_5636