• GLM和Sonnet的真实使用成本差10倍! GLM-5.2和Sonnet 5的定价大战,就像奶茶店第二杯半价和隔壁直接卖桶装水的区别。表面看价格差不多,但喝起来的速度和管饱程度天差地别。 [img]data:image/jpeg;base64,/9j/4AAQSkZJRgABAQAAAQABAAD
  • AI炒股助手Vibe-Trading在GitHub上狂揽近两万星,把量化交易的门槛从写代码拉低到了说人话。它不仅自带四百多个华尔街级别的量化因子,还能让多个AI分析师组队帮你盯盘、写策略、甚至骂你“管不住手”,主打一个让你花钱还让你心服口服。 ### 你还在研究K线,人家已经靠“说”赚钱了 你有没有
  • 别把缓存当神,那玩意儿在AI眼里就是个摆设。 CUDA这堵墙,六家对手没用锤子砸,而是直接绕了过去。他们发现AI干活的路数太死板,根本用不着硬件猜你下一步要干啥。这六个来自不同国家、不同架构的团队,各自闭门造车,结果造出来的车都没装传统缓存,也没用线程打架那一套。这巧合背后,是对AI计算本质的一次集 icon
  • 玩着玩着就把钱赚了,这感觉确实挺魔幻。 一个IT顾问随手用AI工具瞎逛,结果搞出了个月入过万的被动收入流水线。这故事听起来像天方夜谭,但它就发生在Reddit上一个叫Hermes Agent的社区里。主角没写一行复杂的代码,全靠一个能满世界挖客户的人工智能代理,硬生生从那些连网页都没有的本地小商家身 icon
  • 在AI的世界里,最贵的不是算力,是你以为不用花钱的那些开场白。 你有没有想过,当你在AI编程助手里输入一行指令时,背后已经跑掉了多少“隐形消费”?我们干了一件挺无聊但很较真的事:把Claude Code和OpenCode这两个编程助手拉到同一个实验室里,用同一个模型 icon
  • 当一家公司停止和用户好好说话,它的产品再好,也不过是给竞争对手免费打广告。 Anthropic在Fable 5发布后遭遇政府限制,紧接着Sonnet 5又因消耗更多token但性能更弱而引发付费用户不满。与此同时,OpenAI通过取消5小时使用限制、频繁重置额度等操作大幅提升用户体验,6M活跃用户的 icon
  • Kimi K3以3美元/百万输入token的价格杀进市场,Claude Fable 5却要收你10美元——这差价够你请全组喝一个月奶茶,可美国政府还在忙着给自家模型上锁,你说这政策是防贼还是防自己人? 2026年7月,中国AI公司月之暗面(Moonshot A icon
  • 内存池化CXL这东西,说白了就是让AI显卡不用再眼巴巴等着从硬盘捞数据。 华为搞了个叫CloudMatrix 384的大家伙,把192个CPU的内存给串成了一片,专治AI推理时的“内存饥渴”。关键是这项技术对延迟不敏感,但对带宽要求极高,而华为的UB平面正好就是干这个的,相当于他们自己搞的NVLin icon
  • Fable使用量砍半还卖惨?你当用户是傻子吗? Anthropic宣布从7月20日起,Max和Team Premium套餐将包含Claude Fable 5模型,但使用量限制在额度的50%。Pro和Team Standard用户则通过使用额度(usage credits)继续访问,并一次性获得100 icon
  • 大模型开源照样能赚钱,DeepSeek年收入快5亿美金了。 DeepSeek这家公司最近在AI圈讨论度很高,主要是关于钱的事。根据公开信息,它的年度经常性收入( icon
  • 机器人行业突然不吹“像人”了,现在比的是谁能像牲口一样稳定干活。Agility Robotics的Digit已经进厂搬箱子,市场逻辑彻底变了。以前看走路,现在看部署,谁先铺开谁赢,这可能是产业落地最狠的转折点。 ### 资本开关:股市怎么突然给机器人“通电”了 今天的股票代码CCXI突然暴涨,原因不 icon
  • “会计会被AI取代吗?”这个问题最近吵得不可开交。 但一家英国小公司真刀真枪干了一票:用开源AI模型GLM 5.2处理了3个月59笔交易,只花了2.73美元和68分钟,就把季度的增值税申报表做出来了,跟人类会计师做的只差7便士。这相当于用0.2%的成本,达到了99.9%的准确率。 icon
  • 别把注意力机制想得太玄乎,它本质上就是个信息筛选的活儿,只不过现在筛得越来越狠了。 DeepSeek V4搞出的CSA和HCA两种压缩注意力,核心目标就是让大模型在处理超长上下文时别那么费劲。它俩不像MLA那种每个token都保留压缩信息的做法,而是直接对历史tok icon
  • 别再吹国产AI芯片了!这5个死穴不解决,训练大模型还是得看老黄脸色 中国的AI芯片,真的能摆脱对英伟达的依赖吗? 政策强推下,国产算力已经打入政府、央企和电信市场,尤其在做AI推理时表现尚可。但在大模型训练这个真正的硬仗上,算力利用率、软件生态、高带宽内存这些坎,短期内还是迈不过去。 ### 国产算 icon
  • AI对话太烧钱?这个配置让token消耗直接打二五折 你的AI助手带了个智能工具箱,但工具箱里有一万个工具 每次跟AI聊天,它都得先把所有工具的名字和用法背一遍,再听你说话。工具越多,背得越久,你的钱包就越疼。Spring AI搞了个动态工具发现机制,让AI变成了一个懒人,需要用啥工具才去翻工具箱, icon
  • 做对的事情比把事情做对更重要,但在技术路线上,你得先知道什么才是“对的事情”。 CPO热度还没退,华为牵头二十多家企业搞的Open NPO项目已经在2026年7月9日正式启动了。一边是资本市场的概念炒作,一边是产业链真金白银的 icon
  • Anthropic 签署了规模最大的 AI 基础设施协议之一: - Anthropic 与 TeraWulf 签署了一份为期 20 年、价值 190 亿美元的租赁协议,在肯塔基州建造一个专门的 AI 园区,为 Claude 确保高达 401 MW 的计算能力。 TeraWulf从比特币矿商转型AI房 icon
  • 把芯片红绿灯拆了反而更快?两个哈佛辍学生刚拿了8亿美金 一家叫Etched的AI芯片公司,把芯片内部负责数据调度的开关网络整个拆了,让内存直接连上计算单元。这台"死心眼"芯片专门跑Transformer模型,2026年刚拿到8亿美元融资,台积电已经帮他们流片成功,客户订单超过10亿。 ### 芯片里 icon