• 中国大基金正领投DeepSeek首轮融资,其估值一个月内从200亿美元暴涨至450亿美元。创始人梁文峰为防人才被挖角启动此轮融资,腾讯等机构参与跟投。DeepSeek专注AI模型研发,已适配华为芯片,助力构建国产AI生态。 国家钱袋子砸向AI黑马:DeepSeek估值一个月翻倍到450亿美金
  • Cursor发布Composer 2.5,新模型更聪明、能干长活、听话。本文讲讲它怎么训练出来的、跟谁合作、为啥能比同类快10倍,全是技术事实和开发流程,不吹不黑。 Composer 2.5这个新模型,核心就三件事:更聪明、能干长活、听话。聪明说的是它理解复杂指令的能力提升了。能干长活指的是它能处理
  • DeepSeek-Reasonix 是一个专门为 DeepSeek API 优化的终端编程助手。它通过“只往后加内容、绝不改前面”的对话管理方式,把 DeepSeek 的前缀缓存命中率拉到 90% 以上,让长会话的成本降到原来的五分之一左右。 AI 编程一小时只花一毛钱?这个终端工具靠“不翻旧账”做 icon
  • 这是一个帮你省钱的开源工具:把Claude Code的脑子换成DeepSeek V4 Pro,省下17倍成本。身体(工具链、文件编辑、bash执行)完全不变,agent自动循环照跑不误。适合写代码修bug,但不支持图片识别和多工具并行。 这个deepclaude项目干了一件特别贼的事。它不是重新发明 icon
  • DeepSeek把V4 Pro的75折临时优惠变成永久降价到原价1/4,缓存价格降到1/10,开发者疯狂迁移 ### DeepSeek公司把临时打折改成了永久降价 这家公司之前搞了个七五折促销活动,很多人都觉得是短期抢客户的套路。结果他们突然在官方账号发消息说,促销结束后价格不涨回去了,永久定在原价 icon
  • 本文介绍ds4.c项目,一个专为DeepSeek V4 Flash模型设计的轻量级推理引擎。它采用Metal图形计算,支持超长上下文和磁盘KV缓存,强调端到端的本地运行体验。 ### 这个引擎到底是啥 咱们先别整那些虚的。这个叫ds4.c的东西,说白了就是一个专门给DeepSeek V4 Flash icon
  • 华为提出“Tau缩放定律”和“逻辑折叠”技术,目标是到2031年做出相当于1.4纳米密度的芯片。但这不等于华为或中芯国际已经能用老办法量产1.4纳米。这更像一份长期作战地图:用电路、架构和系统设计来弥补没有极紫外光刻机的短板。文章详细拆解了华为实际说了什么、技术上怎么实现、跟台积电的差距有多大,以及 icon
  • 代码审查还在靠人工一行一行看?阿里把这个内部AI工具开源了 Open Code Review(简称 OCR) 是阿里巴巴于 2026 年开源的 AI 代码审查工具。它最初是阿里内部官方代码审查助手,据项目介绍,已经在阿里内部服务数万开发者,并发现过数百万个代码缺陷。 简单来说,它的定位是:用 AI icon
  • 华为开源KV Cache量化技术让大模型上下文提升5倍! KVarN(Variance-Normalized KV-Cache Quantization)是华为计算系统实验室(HUAWEI Computing Systems Lab)刚刚开源的一套KV Cache量化方案,专门解决大模型长上下文推理 icon
  • 本文通过四个实际编码与写作任务的对比测试,分析DeepSeek V4 Pro与GPT-5.5 Pro在精度、指令遵循和可靠性上的表现。DeepSeek在正则匹配、邮件生成、JSON结构严格性上均优于对手,唯一平局出现在简单数据清洗任务。结论指向一个核心观点:在真实生产环境中,“不犯错”比“会花活”更 icon
  • 截至5月12日本周GitHub上最火的开源项目,主要是帮你省钱的AI编程工具和让浏览器装瞎的隐身技术。核心是教你怎么用命令行跟AI聊天、搞到免费AI代币、以及让网页机器人检测不到你。 这周GitHub上最热闹的东西,就是一堆帮你省钱的AI工具。核心就三件事: 第一,让你在自己电脑的终端里就能用上De icon
  • 开源已成战略武器:专家估计,中国开源模型与美国领先闭源模型之间的差距仅约为3至6个月。谷歌、Meta、中国用开源干翻对手、建护城河。自动驾驶和AI正上演同样剧本。不懂这套,你就在裸奔。 开源软件不只是程序员的事。过去十五年,聪明公司用它来干掉对手、省钱、 icon
  • DeepSeek这公司,跟我想的完全不一样 最近看了Hacker News上一篇关于DeepSeek的讨论,里面有个老哥分享了他去DeepSeek总部参观的见闻。看完我的第一反应是:这公司也太佛了吧?在AI这个卷王扎堆的行业里,他们居然活得像个清流。 核心就一句话:DeepSeek把自己当成一家普通 icon
  • 华为τ Scaling核心是把芯片平面道路改成立体高架,通过空间折叠缩短信号路径,用设计和散热换取性能增长。 芯片的平面道路终于堵到动不了了 很多人看到华为芯片等效1.4纳米、能耗提升41%、密度冲到238兆每平方毫米这些数字,脑子里瞬间开始放烟花,感觉晶体管突然像吃了生长激素 icon
  • DeepSeek表面像模型公司,深层动作更像修高速公路的人。模型创新、内存压缩、硬件适配和生态扩散可能共同组成一场更大的产业游戏,但宏大叙事和现实落地之间仍然隔着很多层楼梯。 DeepSeek持续释放技术信号引发巨大想象 过去一年很多人看DeepSeek像看一个突然闯进球场的陌 icon
  • 不拼光刻拼叠罗汉:华为芯片新招的真相!华为Tau缩放用混合键合堆叠7纳米芯片提升密度53.5%,避开极紫外光刻限制。但键合机受制于人,且领先节点若同样堆叠会拉大差距。 ### 先给你说个结论:华为这个“Tau缩放定律”,说白了就是靠叠罗汉来骗过物理课代表 华为搞了个新玩法,不跟别人比谁家晶体管刻得更 icon
  • 快和聪明哪个更重要:每秒1000词的AI如何改变一切?传统慢速模型(如Claude)带来的多任务困境与迭代效率低下!小米MiMo-v2.5-Pro-UltraSpeed模型每秒1000词,从“求AI办事”到“随口聊天”!模型变快不是升级,是革命:1000词/秒如何让你不再精神分裂 本文探讨了AI模型 icon
  • 字节跳动AI学会写CUDA,而且比人类专家强40%——英伟达的护城河正在被强化学习拆掉 一个让英伟达股东后背发凉的消息 先别急着看股票,我给你说个真事儿。字节跳动最近发了一篇论文,里面讲的东西,要是你手里有英伟达的股票,看完可能想关掉电脑冷静一下。 icon