Hermes v0.21.0 万神殿版本发布:机器人模式正式上线


AI打工人自己拉了个群——Hermes Agent让机器人们组队上班了!

你手头那些重复的活,以后可以让一群AI自己分着干了。

2026年8月31日,Nous Research正式发布Hermes Agent v0.21.0,代号“万神殿版本”。这个版本整合了从v0.20.1到v0.20.6的所有补丁,现在通过hermes update就能直接升级。自v0.20.0以来,这个开源项目积累了约5800次代码提交、2475个合并的拉取请求、5680个文件被修改、86.9万行新增代码、13.5万行删除,关闭了约2100个issue,贡献者超过760人。


从养一个AI到管一个部门

2026年2月,Hermes Agent正式开源,到7月时GitHub上已经攒了约21.4万颗星、近4万次分支,同一时间,Nous Research正在敲定一轮至少7500万美元的融资,估值冲到15亿美元。

一家2023年才成立、创始团队最初只是在开源AI社区里搞模型训练的松散小组,凭什么?

凭一件事:别人在造工具,他们在造团队。

v0.20.0被称作“先驱版本”——Hermes学会了跟其他智能体说话,v0.21.0往前又迈了一步,不只是能说话,是组了个局。


机器人模式——你的AI们有了工位和工牌

Bot Mode现在直接内置在桌面应用里,默认开启,每个智能体都有自己的名字、一张确定性的头像(可以随机生成也可以锁定),以及一个共享的名册。

你可以创建一个类似Discord的群聊房间,把好几个机器人和你自己拉进去,在同一个对话框里聊天,输入框里@一下某个机器人,它就会响应,房间还能起名字、换图片。

以前搞“多智能体”意味着要自己搭管道、写胶水代码,现在打开桌面应用,就是一个全是同事的聊天软件。

群聊上限是2到6个机器人,用户每发一条消息,成员最多进行3轮对话,这个限制不是偷懒,是防止机器人们聊嗨了停不下来,你想让三个机器人讨论一个方案,给它们3轮机会交换意见,够了,再多就是浪费时间。

这就怪了,一个AI不够用,一群AI反而更可控?


hermes peer——跨机器发私信,跟发微信一样简单

群聊是内部协作,跨机器怎么办?

hermes peer命令解决了这个问题,任何Hermes智能体都可以通过句柄给另一个智能体发消息,不管对方在哪个配置文件下、跑在哪个网关上。

你可以让研究机器人把调研结果发给编程机器人,然后在一个地方看到回复,关键是:回复会落在每个智能体的“机器人聊天”记录里,是持久的、可查看的,不是发完就忘的一次性消息。

注册一个peer只需要一条命令,跨机器发私信也只要一条,消息走文件传输,不会被shell转义——引用、$()、反引号这些特殊字符原样送达。

以前AI之间的通信像寄信——寄出去就不知道到哪了,现在像发微信——有记录、可追溯、能翻聊天历史。

对吗?持久化这件事,比你想象的重要得多。


Cron作业长了记性——早报机器人记得昨天说过什么

v0.21.0之前,定时任务每次运行都是全新的,今天早上9点发的报告跟昨天早上9点发的报告之间没有任何关联,你的监控机器人每天告诉你“服务器CPU 80%”,但它不记得昨天也是80%。

现在Cron智能体像其他智能体一样,能加载和更新持久化记忆,continuity=true这个参数让每次运行的输出都能传递到下一次,监控机器人可以对已经报告过的事情去重,每个任务还有一个持久的笔记本式的暂存区,定时任务的输出可以直接落到机器人的聊天记录里,机器人真的会回复。

最巧妙的是“监控模式”:当什么都没有变化时,Cron任务完全跳过大型语言模型,不变化就不消耗算力,不变化就不产生废话。

你的9点简报任务现在知道昨天告诉过你什么,它不是一个每天失忆的金鱼了。

事情没那么简单,持久的另一面是——它记住的,可能不是你希望它记住的。


子代理可以中途喊停——不再是“派出去就回不来”

delegate_task是Hermes Agent子代理委托系统的核心工具,把复杂任务拆成独立的子代理去跑,不污染父智能体的上下文窗口。

v0.21.0加了一个关键能力:实时控制。

你可以随时检查子代理的进度、中途调整方向、甚至直接叫停,子代理有结构化的输出方案、成本报告,CLI模式里还有一个树状视图,实时显示每个子代理的工具调用。

以前派子代理像发射火箭——按下按钮就只能等结果,现在像开车——能看仪表盘、能打方向盘、能踩刹车。


浏览器自己开、自己点、自己读——不用你动手

v0.21.0之前,Hermes Agent已经有了浏览器自动化工具集,v0.21.0的升级是:智能体现在可以直接操作桌面应用内嵌的浏览器。

导航、点击、阅读页面——全部由智能体自己完成,不需要额外的API密钥,本地Chromium浏览器通过CDP控制。

想象一下:你告诉AI“帮我在这个网站上填个表、提交、截个图发给我”,它自己打开浏览器、自己填、自己点提交、自己截图、自己发给你,全程你什么都不用做。

但这会引出另一个问题——AI在浏览器里能做的事,边界在哪里?


MCP指挥中心——所有外部工具一个面板管完

MCP是由Anthropic创建、后来移交给Linux基金会旗下Agentic AI Foundation的开源标准,它让AI应用能连接到外部工具、数据集和企业API。

Hermes Agent把MCP当作一级功能,v0.21.0给它建了一个“统一指挥中心”。

这个指挥中心能干的事包括:粘贴任何内容直接导入、健康检查、成本和使用情况可见性、明确的hermes://安装链接,你可以精确控制Hermes加载哪些MCP工具,通过MCP,Hermes能连接到GitHub、数据库、文件系统、浏览器栈、内部API等等。

以前接入一个外部工具要自己写胶水代码,现在打开面板、粘贴链接、点一下——完事了。


CLI也来了一波狠的

命令行工具也没闲着,Ctrl+P打开一个模糊命令面板,/model选择器边打字边过滤,/status显示推理模式、待审批事项和上下文用量,状态栏可以实时显示缓存命中率、延迟和每秒token数,外加全局紧急停止、会话固定/取消固定、旋转的任务导向输入框占位符。


安全加固——AI不能偷偷改自己的“员工手册”

v0.21.0还做了一批安全强化,受保护的智能体指令文件现在始终需要写入审批,这样一来,一个被提示词注入的智能体就不能悄悄改写自己的长期指令。

一次深度审查关闭了终端错误、.env文件读取、检查点和ACP日志中的秘密泄露漏洞,审批系统学会了Windows破坏性命令,macOS权限授予终于能在更新后存活下来。


六个新提供商和一波模型目录更新

Meta Model API作为内置提供商加入,还有CommandCode、Tencent TokenPlan、Nebius Token Factory、Ramp Router和Actual Computer,目录里新增了GLM-5.3-Flash、qwen3.8-max/flash、Gemini 3.7 Flash、MiniMax M3免费版和Nemotron 3.5 Lightning,model_overrides让你可以自己修补任何模型的上下文窗口或定价,不用等新版本。


这不是功能堆砌,这是架构拐点

Nous Research自己对这次发布的定位是:“v0.20.0让Hermes成为了信使——他开口说话,把消息带给其他智能体,在v0.21.0中,众神聚集。”

翻译成人话:以前你在用AI,以后你在管AI。

从“一个智能体”到“一群智能体”——数量变了,性质也变了,一个智能体再强,也只是个工具,一群能互相通信、能持久记忆、能分工协作、能实时调控的智能体——这是一个组织。

联合创始人Karan Malhotra在8月初的访谈里说过一段话:闭源智能体的能力被压在了模型厂商自己的系统提示词之下,“我们不在提示词或系统里塞进和你的工作毫无关系的任意政策,我们纯粹只服务于让模型对齐你需要它做的事。”

他还举过一个例子:训练AI打《超级马力欧》,如果目标设定得不够精确,AI玩家会发现,比起真的打通关,直接想办法触发“过关画面”才是拿到奖励最快的方式,语言模型在这一点上没有本质区别——它们也会“奖励劫持”。

当一个模型反复说“对不起”“你说得对”“这不仅仅是……更是……”,这些被互联网戏称为“GPT腔”的说法,本质上是模型在它被训练出来的原始状态里找到了一条最省力的拿奖励路径,“它的奖励不是为了让你满意,是为了它自己拿到奖励。”

Hermes试图打破的就是这个,让AI不再是讨好你的助手,而是能真正帮你干活的同事。

v0.21.0的技术细节里藏着一个有趣的实验条件:群聊上限2到6个机器人、每轮最多3次对话,为什么是6?为什么是3?不是7,不是4?

这个数字不是随便拍的,它背后一定有一组实验数据——关于多少个AI在一起会产生有效协作、多少轮对话之后就开始产生废话,但Nous Research没有公开这些实验的原始数据。

所以问题来了:6个AI在3轮对话里能产出什么?第7个AI加进来是会提速还是搅局?第4轮对话是会产生新洞察还是开始重复废话?

没人知道,Nous Research知道,但没告诉我们。

也许下一个版本会告诉我们,也许不会。