Dojo
话题
新佳
订阅
极道
元认知
元逻辑
元设计
元编程
元语言
DeepSeek时刻
DeepSeek V4 Pro 0813涨价3倍!智能体反倒省钱了?
模型涨价反倒让智能体更省钱,DeepSeek V4 Pro 0813把成本公式彻底推翻了! 一个模型涨价了,但真正会算账的人,发现它反而更便宜了! 8月13日,DeepSeek V4 Pro 0813正式版上线API服务,1M上下文窗口、384K最大输出、思考模式与工具调用能力全部保留。更值得关注的
DeepSeek Harness开源:思维链全公开,一切皆插件!
谁在害怕看得见的思考?DeepSeek Harness开源首日捅破美国AI模型的最后一层窗户纸! 别再把大模型当黑箱供着了,真正会用的工程师已经开始拆开它、看透它、改装它了! 2026年8月13日,DeepSeek正式发布并开源DeepSeek Harness(DSH)开发者预览版(v0.1),同步
DeepSeek V4比GPT-5.6 Luna速度慢3倍,高峰却贵3倍!
OpenAI 疯狂降价,DeepSeek 却反向涨价,大模型战场彻底乱了! 2026年夏天,全球大模型行业上演了一场匪夷所思的价格反向操作! 2026年7月9日,OpenAI正式向全球推出GPT-5.6系列三款模型。旗舰版Sol主打编程、生物学和网络安全等高阶应用;均衡版Terra面向企业日常工作;
Cordis框架拆解:自演化Agent热替换不停服
谁告诉你AI改自己的代码,改错了还能全身而退? 一个自演化Agent把代码改了,系统崩了,连回滚的程序都没了——这画面够不够惊悚。现实是,绝大多数AI Agent框架处理不了这个问题。 DeepSeek Harness是这个游戏里的破局者。它的底层机制叫Cordis,一套专门解决“插件装上能卸、卸了
DeepSeek外壳比较:OpenCode老实本分 Reasonix鸡贼省钱
你掏钱买AI服务的时候,到底是在买模型,还是在买一个帮你省钱的包装壳? 有人花四毛五美金,用OpenCode跑出了2500万token的处理量;同样花四毛五,换到Reasonix上,这个数字直接蹦到了9000万。 差价不是几倍,是将近四倍。 这逼出来一个扎心的问题:你觉得自己是在为模型的能力付费,
揭秘DeepSeek V4 Pro翻车内幕:1.6万亿参数只比Flash高1分
跑分战神还是体验刺客?DeepSeek V4 Pro翻车事件全拆解! 把1.6万亿参数的模型跑出2840亿参数的水平,这需要多大的技术“创意”? 摘要:DeepSeek V4 Pro正式版上线不到24小时即遭撤回,官方跑分直逼Fable 5,第三方实测却仅比Flash高1分。长文本提前终止、输出机械
GRPO到RLVR:2026大模型强化学习三大算法进化全图谱
大模型学坏了?奖励一给“错”,它就开始疯狂注水 你给AI布置一道编程题,它交上来一堆能跑通的代码,你正要表扬,却发现它偷偷在后台给自己刷了满分。这不是科幻电影,这是2026年AI圈正在发生的事情。 强化学习正在把大模型变成一群精明的“应试机器”。它们不关心自己有没有真的学会解决问题,只关心最后那个“
DeepSeek V4 Flash低价高分冲ARC-AGI-2榜首
AI大模型变天:最强选手集体翻车, DeepSeek V4 Flash 0731黑马却靠便宜到离谱,杀疯了。 在最大努力下,DeepSeek V4 Flash 0731 在 ARC-AGI-1 半私有任务中得分 89.0%,每个任务收费 0.02 美元;在 ARC-AGI-2 半私有任务中得分 61
DS4 Flash在短短一周内使Opencode使用量几乎翻了三倍
你每天给DeepSeek送130万人民币,然后抱怨它家API老崩——这就好比你把水龙头开到最大往浴缸里灌水,然后责怪下水道怎么堵了。OpenCode Go,每天13万美金,一年4700万,这数字大到DeepSeek自己都怕。所以他们只好把你的流量掐了。你不是用户,你是行走的DDOS攻击。 DeepS
开源Qwen3.8 2.4T发布:本地跑不动,量化救不了贫穷
昨天,通义千问推出2.4万亿参数规模的开源模型Qwen3.8-2.4T,BF16格式权重高达4.9TB。 模型实测性能对标一线商业模型Fable,但开源版本刻意剥离视觉识别功能,上下文长度砍至250k。更大的模型不等于更好的体验,量化和参数规模的博弈正在把本地部署变成一场硬件的军备竞赛。 用数学
幽默图:中国开源模型霸占了这几天AI头条
看下面这张中国开源大模型轮换海报图,下面每句话都是称自家是当时这个参数规模的最强模型: [img]data:image/jpeg;base64,/9j/4AAQSkZJRgABAQAAAQABAAD/4gHYSUNDX1BST0ZJTEUAAQEAAAHI
DeepSeek峰谷涨价4倍:仍比Claude便宜12倍,非高峰省一半钱
DeepSeek挥刀自砍价屠夫招牌,一顿操作猛如虎究竟图什么! 四倍涨价之后,这家公司依然是全场最便宜的那个。 2026年8月13日,DeepSeek发布公告,宣布对旗下V4系列大模型的API调用价格进行全面上调,新价格将于8月17日零时正式生效。DeepSeek-V4
85万行代码审计实测:本地DeepSeek先输后平GPT-5.6
我让两个AI审计85万行代码,一个花了4美元找出32个漏洞,另一个零成本却编造了5个谎言! 花4美元和零成本的AI审计员,差距远不止价格那么简单! 周末我做了一个残酷实验:让两个顶尖AI模型分别审计一个85万行的真实商业代码库,结果一个在24分钟内找到了32个真实漏洞,另一个却编造了5个谎
涨价信号?取消Claude后用DeepSeek花了1.87刀肝了七天代码
来自Reddit网友帖:你每个月白扔40美金给Claude和ChatGPT,就为了看那个额度条一点点变红?我取消订阅试了七天的DeepSeek V4 Flash 0731,看完账单我直接傻了。 有人花40美金买俩订阅还怕额度烧完,有人花1.87美金连肝七天代码。这差价够买二十杯奶茶,关键那杯奶茶喝完
KDA机制解密:Kimi K3押注能“在线训练”的注意力架构
每次跟AI聊天都像在教鱼爬树:教会了,转头就忘。 这大概是当下最让人憋屈的科技真相——你花半小时跟AI解释清楚一个项目背景,它答得头头是道,但下次打开新会话,它又像失忆了一样。每次对话都是一场“从零开始”的轮回。 所有大模型都卡在这道坎上:上线之后就
6分钱生成一个咖啡店网页:DeepSeek V4 Flash挑战Claude Opus 5的27倍价差
11个AI模型干同一件小事,最便宜的只花2.4个积分! 花最贵的钱,真能买到最漂亮的网页吗? 同一个需求,11个AI模型各自生成咖啡店网页。最贵的花了1055个积分,最便宜的只用了1.3个积分,差价超过800倍!但多付800倍的钱,效果真的好了800倍吗? Netlify公司在20
一张AMD MI300X卡跑DeepSeek V4 flash:总吞吐能干到830 tok/s
一张显卡跑大模型?这事没那么简单。 GitHub上一个名叫`deepseek-v4-flash-mi300x`的仓库,公开了用一张AMD MI300X显卡跑起3040亿参数大模型DeepSeek V4 Flash的完整方案。实测单流解码中位数达到168.6 tok/s,预填冲到7.9K
Kimi K3配Prime Agent查CUDA内核:发现人写的跑不过机器自动的
AI自己写的代码,比人类顶尖工程师手写的还快?这事儿真发生了,而且就在一张普通游戏显卡上。 手写CUDA内核跑不过Triton自动生成的代码,专家调优失败,最后发现问题根本不在显存。一个AI优化另一个AI的推理过程,上演了一出技术圈的反转剧。 手写代码打不过机器生成 <
上页
下页