<?xml version="1.0" encoding="UTF-8"?>
<?xml-stylesheet href="/js/rss-style.xsl" type="text/xsl"?><rss xmlns:content="http://purl.org/rss/1.0/modules/content/" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:taxo="http://purl.org/rss/1.0/modules/taxonomy/" version="2.0"><channel><title>极道</title><link>http://www.jdon.com/</link><description>探索 分享 交流 解惑 授道 。更多关注见https://www.jdon.com/followus.html</description><item><title>Qwen 3.8 27B叫板Opus：拉长思考时间补参数不足</title><link>http://www.jdon.com/93991-qwen-3-8-27b-vs-opus-42-percent-swe-bench-21-minut.html</link><description>Qwen 3.8 27B打败Opus？27B如何用20分钟思考干翻万亿参数巨无霸！ 从今天起，本地运行的27B小模型，竟敢单挑硅谷万亿参数巨兽，这事儿绝没有表面上那么简单！ 2026年8月15日，阿里通义实验室开源了Qwen 3.8 27B模型。这个仅有270亿参数的“小个子”，在DeepSWE编程基准测试中拿下了42.2%的通过率，硬生生把Anthropic家那个号称顶级旗舰的Opus 4.6 Max（40%）踩在脚下。发布仅仅六个小时，Hacker News上的讨论就炸了锅——710分，452条</description><category domain="http://www.jdon.com/tag/97174/">DeepSeek时刻</category><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><pubDate>Fri, 14 Aug 2026 21:45:00 GMT</pubDate><guid>http://www.jdon.com/93991-qwen-3-8-27b-vs-opus-42-percent-swe-bench-21-minut.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-14T21:45:00Z</dc:date></item><item><title>揭秘DeepSeek V4 Pro翻车内幕：1.6万亿参数只比Flash高1分</title><link>http://www.jdon.com/93986-deepseek-v4-pro-performance-issue-may-be-due-to.html</link><description>跑分战神还是体验刺客？DeepSeek V4 Pro翻车事件全拆解！ 把1.6万亿参数的模型跑出2840亿参数的水平，这需要多大的技术“创意”？ 摘要：DeepSeek V4 Pro正式版上线不到24小时即遭撤回，官方跑分直逼Fable 5，第三方实测却仅比Flash高1分。长文本提前终止、输出机械重复、不同用户体感天差地别——这场“静默发布、高调撤回”的闹剧背后，三个致命的技术失误浮出水面。 静默发布，高调翻车</description><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><category domain="http://www.jdon.com/tag/97174/">DeepSeek时刻</category><pubDate>Fri, 14 Aug 2026 10:19:00 GMT</pubDate><guid>http://www.jdon.com/93986-deepseek-v4-pro-performance-issue-may-be-due-to.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-14T10:19:00Z</dc:date></item><item><title>Claude背后女王：拍成人片逆袭2万亿的传奇人生</title><link>http://www.jdon.com/93985-anthropic-s-first-lady-took-a-winding-road-to-th.html</link><description>埃隆·马斯克带工程师，黄仁勋带保镖，但达里奥·阿莫迪带去见莫迪的，是他的妻子！ 当全球AI领袖齐聚新德里，每位CEO只准带一个人入场，Anthropic的CEO带的是自己的妻子。她没有任何头衔，在公司架构图上找不到名字，连Anthropic自己的聊天机器人Claude都回答不出她的身份。可她坐在达沃斯前排、出入Sun Valley闭门会、与法国总统马克龙会面、和伊万卡·特朗普共进午餐。 更关键的是：她亲手把前谷歌CEO埃里克·施密特拉进了Anthropic的早期投资阵营。</description><category domain="http://www.jdon.com/tag/30661/">AI人工智能指南</category><category domain="http://www.jdon.com/tag/29493/">AI投资新闻</category><category domain="http://www.jdon.com/tag/5676/">《道德经》认知哲学</category><pubDate>Fri, 14 Aug 2026 10:04:00 GMT</pubDate><guid>http://www.jdon.com/93985-anthropic-s-first-lady-took-a-winding-road-to-th.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-14T10:04:00Z</dc:date></item><item><title>DeepSeek V4比GPT-5.6 Luna速度慢3倍，高峰却贵3倍！</title><link>http://www.jdon.com/93968-token-price-gpt-5-6-luna-vs-deepseek-v4.html</link><description>OpenAI 疯狂降价，DeepSeek 却反向涨价，大模型战场彻底乱了！ 2026年夏天，全球大模型行业上演了一场匪夷所思的价格反向操作！ 2026年7月9日，OpenAI正式向全球推出GPT-5.6系列三款模型。旗舰版Sol主打编程、生物学和网络安全等高阶应用；均衡版Terra面向企业日常工作；轻量版Luna则定位为速度快、价格实惠的高吞吐量模型。三款模型覆盖了从尖端到经济型的完整产品线。 仅仅22天后，7月31日，OpenAI突然宣布将Luna价格下</description><category domain="http://www.jdon.com/tag/30661/">AI人工智能指南</category><category domain="http://www.jdon.com/tag/612/">AI基础设施</category><category domain="http://www.jdon.com/tag/29493/">AI投资新闻</category><category domain="http://www.jdon.com/tag/97174/">DeepSeek时刻</category><pubDate>Thu, 13 Aug 2026 23:21:00 GMT</pubDate><guid>http://www.jdon.com/93968-token-price-gpt-5-6-luna-vs-deepseek-v4.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-13T23:21:00Z</dc:date></item><item><title>DeepSeek峰谷涨价4倍：仍比Claude便宜12倍，非高峰省一半钱</title><link>http://www.jdon.com/93967-deepseek-increases-prices-for-ai-services-by-multi.html</link><description>DeepSeek挥刀自砍价屠夫招牌，一顿操作猛如虎究竟图什么！ 四倍涨价之后，这家公司依然是全场最便宜的那个。 2026年8月13日，DeepSeek发布公告，宣布对旗下V4系列大模型的API调用价格进行全面上调，新价格将于8月17日零时正式生效。DeepSeek-V4-Flash模型在高峰时段每百万输出token收费1.32美元，非高峰时段0.66美元，而此前的统一价格仅为0.28美元。DeepSeek-V4-Pro模型高峰时段涨至3.96美元，非高峰时段1.98</description><category domain="http://www.jdon.com/tag/30661/">AI人工智能指南</category><category domain="http://www.jdon.com/tag/97174/">DeepSeek时刻</category><category domain="http://www.jdon.com/tag/29493/">AI投资新闻</category><category domain="http://www.jdon.com/tag/612/">AI基础设施</category><pubDate>Thu, 13 Aug 2026 23:10:00 GMT</pubDate><guid>http://www.jdon.com/93967-deepseek-increases-prices-for-ai-services-by-multi.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-13T23:10:00Z</dc:date></item><item><title>Gemini 3.7 Flash 半价促销，四个月后价格自动翻倍</title><link>http://www.jdon.com/93961-gemini-3-7-flash-intelligent-workhorse.html</link><description>Gemini 3.7 Flash 半价促销，但这张定价牌藏着四个月的有效期！ Google 发布了 Gemini 3.7 Flash，价格直接砍半。但促销价只持续到今年年底，四个月后自动翻倍，一个新的发布逻辑已然显现。 Google 在 2026 年 8 月 13 日推出了 Gemini 3.7 Flash。这款被官方称为最聪明的干活模型，在编码和代理任务上比 3.6 Flash 有了明显提升。然而，最引人注目的不是性能，而是那张附有截止日期的定价牌：每百万输入 tokens 0.75 美元，输出 toke</description><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><pubDate>Thu, 13 Aug 2026 21:43:00 GMT</pubDate><guid>http://www.jdon.com/93961-gemini-3-7-flash-intelligent-workhorse.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-13T21:43:00Z</dc:date></item><item><title>AI变天：Grok 4.6半价打平GPT-5.6，Grok 4.7吃进SpaceX全量数据</title><link>http://www.jdon.com/93955-grok-4-7-is-significantly-better-than-4-6-elonmusk.html</link><description>SpaceX正在用造火箭的手感，重新训练一个AI的大脑！ Grok 4.6刚上线，Grok 4.7已经在路上。马斯克给所有人剧透了一场更狠的操作：把SpaceX从创立第一天到现在的所有内部数据——包括Slack聊天记录、Jira工单、GitHub代码库、ERP财务系统——全部塞进Grok 4.7的肚子里进行补充训练。这哪里是升级模型，这是在用一家商业航天巨头二十多年的真实作战经验，喂出一个有实战手感的数字生命体。2.1万亿参数加火箭数据，这套组合没有先例</description><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><category domain="http://www.jdon.com/tag/30661/">AI人工智能指南</category><category domain="http://www.jdon.com/tag/612/">AI基础设施</category><pubDate>Thu, 13 Aug 2026 03:30:00 GMT</pubDate><guid>http://www.jdon.com/93955-grok-4-7-is-significantly-better-than-4-6-elonmusk.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-13T03:30:00Z</dc:date></item><item><title>伊利亚320亿推动AI范式变革：测试时训练让AI边用边学</title><link>http://www.jdon.com/93954-ilya-ssi-test-time-training-ttt-model-release.html</link><description>规模时代结束之后，伊利亚·苏茨克维到底端出了什么！ SSI首个模型即将落地，一场关于AI学会“边干边学”的认知手术即将开始！ 2026年8月，一个估值320亿美元、员工仅33人的AI实验室，即将推出它的第一个模型。这家名为“安全超级智能”（Safe Superintelligence，简称SSI）的公司，由OpenAI前首席科学家伊利亚·苏茨克维于2024年创办。SSI成立两年未发布任何产品、未发表任何论文、未公开任何技术细节。 它累计融资约70亿美元，投资方包括</description><category domain="http://www.jdon.com/tag/103292/">持续学习CL</category><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><category domain="http://www.jdon.com/tag/30661/">AI人工智能指南</category><category domain="http://www.jdon.com/tag/91445/">AGI通用人工智能</category><pubDate>Thu, 13 Aug 2026 03:11:00 GMT</pubDate><guid>http://www.jdon.com/93954-ilya-ssi-test-time-training-ttt-model-release.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-13T03:11:00Z</dc:date></item><item><title>开源Qwen3.8 2.4T发布：本地跑不动，量化救不了贫穷</title><link>http://www.jdon.com/93947-qwen3-8-2-4t-hacker-new.html</link><description>昨天，通义千问推出2.4万亿参数规模的开源模型Qwen3.8-2.4T，BF16格式权重高达4.9TB。 模型实测性能对标一线商业模型Fable，但开源版本刻意剥离视觉识别功能，上下文长度砍至250k。更大的模型不等于更好的体验，量化和参数规模的博弈正在把本地部署变成一场硬件的军备竞赛。 用数学的极限来重新定义贫穷 2026年8月13日，一个2.4万亿参数的模型被扔进了开源社区。参数两个字，在普通人的耳朵里就是一个数字。但在AI圈</description><category domain="http://www.jdon.com/tag/612/">AI基础设施</category><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><category domain="http://www.jdon.com/tag/89861/">本地小语言模型</category><category domain="http://www.jdon.com/tag/97174/">DeepSeek时刻</category><pubDate>Wed, 12 Aug 2026 22:23:00 GMT</pubDate><guid>http://www.jdon.com/93947-qwen3-8-2-4t-hacker-new.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-12T22:23:00Z</dc:date></item><item><title>DeepSeek V4 Pro 0813涨价3倍！智能体反倒省钱了？</title><link>http://www.jdon.com/93946-deepseek-v4-pro-0813-is-out-hermes.html</link><description>模型涨价反倒让智能体更省钱，DeepSeek V4 Pro 0813把成本公式彻底推翻了！ 一个模型涨价了，但真正会算账的人，发现它反而更便宜了！ 8月13日，DeepSeek V4 Pro 0813正式版上线API服务，1M上下文窗口、384K最大输出、思考模式与工具调用能力全部保留。更值得关注的是，它与V4 Flash之间形成了明显的速度、能力、价格三层分化。对于Hermes Agent这类需要连续调用工具、执行多轮任务的智能体来说，真正值得观察的已经不是单次回答有多聪明，而是模型到底能不能少走弯路、少</description><category domain="http://www.jdon.com/tag/108020/">Hermes</category><category domain="http://www.jdon.com/tag/97174/">DeepSeek时刻</category><category domain="http://www.jdon.com/tag/49140/">大语言模型LLM</category><category domain="http://www.jdon.com/tag/29493/">AI投资新闻</category><pubDate>Wed, 12 Aug 2026 21:44:00 GMT</pubDate><guid>http://www.jdon.com/93946-deepseek-v4-pro-0813-is-out-hermes.html</guid><dc:creator>banq</dc:creator><dc:date>2026-08-12T21:44:00Z</dc:date></item></channel></rss>
