• DeepSeek V4.1跑分暴涨却遭开发者痛骂! 同一个模型,有人夸它跑分超越旗舰,有人说它连一个简单脚本都写不对! DeepSeek在2026年9月10日发布了V4.1 Flash,552B参数、全新CED架构、价格大跳水,官方跑分全面超越自家V4 Pro。可上线不到24小时,开发者社区就炸了锅
  • DeepSeek Harness正在自毁式重建,你的插件明天可能全废掉! DeepSeek Harness(DSH)这个刚开源不到一个月的智能体框架,正在以一种近乎“自毁”的方式重写自己的地基——而你的插件,可能明天就全废了。 2026年8月,DeepSeek在开源自家Agent框架DeepSeek
  • Archify 是一个面向 AI 编程助手的图表生成系统,能让 Agent 在对话中直接生成美观、可验证的系统架构图、工作流图、序列图、数据流图和生命周期图。 核心理念 Archify 的核心思路是:Agent 生成结构化的 JSON IR(中间表示),Archify icon
  • OpenDesign 是一个开源的“Claude Design”替代方案,其核心理念是将你本地的各类 AI 编程助手(如 Claude Code、Cursor 等)变成为一个强大的“设计引擎”。 简单来说,它不是一个从零开始的设计工具,而是一个“设计操作系统”,通过整合你的AI代理、本地文件和品牌规 icon
  • 一群AI智能体干翻了100个资深工程师组成的团队,而且干得“非常轻松、极其容易”! 这话不是科幻小说的桥段,是Meta首席AI官 Alexandr Wang 在YC创业学校2026舞台上亲口说的。台下坐着几千个创业者,技术管理层听完直接沉默了。但真正让人后背发凉的,不是100个人被比下去这件事本身。 icon
  • LoopX 是一个面向长程 AI Agent 的开源控制平面,由字节跳动 AML 高级机器学习工程师黄瑞腾(huangruiteng)开发,于 2026 年 5 月 31 日首次公开。它不替代 Codex、Claude Code 等 Agent 运行时,而是运行在这些运行时之上,为长时间运行的 Ag icon
  • OtoDock 是一个自托管的 AI 智能体平台,定位为“公司的操作系统”(The agentic company OS)。它允许你创建、部署和管理多个 AI 智能体,让它们像公司员工一样在各部门中协作、使用各种工具,并在无人监督时自主持续工作。 该项目由开发者 Dimitris Mourtzis icon
  • 这个i-have-adhd为编程助手(如 Claude Code)提供了一套“技能”,旨在让助手的回答更简洁、直接,避免冗长和模糊的表述。 ## 项目目标与解决的问题 很多 AI 编程助手在回答时,常常会先铺垫一大段思考过程,或者以“希望这能帮到你!”等客套话结尾,这容易让用户抓不住重点。 i-ha icon
  • AURA 是一个专为生产环境 SRE(站点可靠性工程)工作设计的开源 AI Agent 平台。 它的核心目标是解决一个关键难题:如何将大语言模型(LLM)的能力安全、可控地应用于复杂的生产环境中,进行故障排查和根因分析! 典型应用场景 从文档和演示来看,AURA 非常适合以下场景: icon
  • 绝大多数 AI 智能体系统越用越废,根本不是模型不够强! 很多人拼命优化提示词、更换大模型,却始终逃不开 AI 智能体用一周就失效的魔咒! 当下主流的 AI 智能体搭建思路,普遍存在致命短板,单纯依靠提示词驱动的智能体,只会机械重复错误,无限循环无效工作,无法实现自我迭代优化。而全新的多智能体工程体 icon
  • ECC (Everything Claude Code) 是一个为 AI 编码代理(Agent)设计的性能优化系统与操作层。它并非模型或 IDE,而是在 Claude Code、Codex、Cursor 等代理工具之上,提供的一套包含技能、记忆、安全与工作流的完整工程系统。 项目概述 ECC 由 A icon
  • 花更少的钱让Claude干更多的活:Anthropic官方降本三板斧,把API账单砍掉一半! 把大模型当成吞金兽的日子,该结束了! Anthropic官方刚刚放出了一套组合拳,教你如何在不牺牲性能的前提下,把Claude的API账单砍掉一大截。从提示缓存命中率的最大化,到移除那些专门拖累最新模型的“ icon
  • DeepSeek Harness Windows Native 是一个为官方 DeepSeek Harness 打造的 Windows 原生桌面应用。 它的核心价值在于:无需打开浏览器标签页,双击一个可执行文件就能在独立的原生窗口中运行 dsh web,所有会话和设置都保留在这个专属窗口中。 窗口由 icon
  • 谷歌让智能体在虚拟世界里反复做梦演练搜索路线,真实算力开销直接砍掉162倍! 智能体变强原来不用疯狂烧钱跑实验,换一套搜索打法就够了! 递归自提升智能体Dream-RSI把历史探索记录组装成回放模拟器,让搜索策略在虚拟决策树上反复跑分迭代,底层模型一行不改,最高压缩162倍大模型调用量,同时保住算法 icon
  • 两个顶级开源AI智能体——Hermes Agent和OpenClaw,被同一个人用真实工作反复折腾了五轮。 结果呢?会偷偷学习、自动记忆的那位被踢出了主力阵容;需要你手把手教、慢吞吞的那位反而上位了。 为什么?因为你随口夸了它一句“这个想法不错”,它就把这句话变成了全球通用规则,接下来几个月里把你每 icon
  • 2025年9月,ToolJet上线了一套多智能体系统,能用AI自动生成内部工具应用。当时这玩意在业内算顶级水平,客户对比了好几家产品后都点头说好。然后团队就掉进了一个坑——连续迭代了将近十一个月。 到2026年夏天,客户对这系统的反应完全变了。他们不再觉得“能用AI生成应用”有什么稀奇。与此同时,R icon
  • 2026年9月一个叫jev的分类API突然炸场,号称用零头成本就能打平OpenAI最强的GPT-5.6-terra! 你花一块钱能办的事,为什么非要花一百块让大模型来干? jev是一个只做文本分类的轻量接口,GPT-5.6-terra是OpenAI的通用大模型,两者在分类任务上性能几乎持平,但调用成 icon
  • 加州大学伯克利分校的团队发现,你给同一个AI大脑换上不同的外壳,账单能差出五倍,活儿却干得一样多! 你的AI编程助手正在悄悄多收你一笔隐形税! 伯克利团队用七个模型和三个调度壳跑了两千多次编程测试,发现同一个模型换壳后成功率几乎不变,但成本最高差五倍,最小壳反而最省钱。 icon