别让你的AI还活在打字时代——Hermes 0.20 和 Open WebUI 0.11 这波更新,把智能助手从"工具"推到了"伙伴"

Hermes 0.20 带来实时对话式语音和 A2A 多智能体协议,Open WebUI 0.11 全面重做界面并加入子代理系统。两个版本在同周发布,标志着 AI 助手从"需要学习的工具"到"学习你的伙伴"的关键转折。站在普通用户视角,一文讲清你能感受到的所有变化。

别让你的AI还活在打字时代——Hermes 0.20 和 Open WebUI 0.11 这波更新,把智能助手从"工具"推到了"伙伴"

你有没有过这种体验——半夜躺在床上,脑子里突然冒出一个想法,想让 AI 帮你查点资料或者写段代码。但一想到还得爬起来打开电脑、敲字、等回复……算了,明天再说吧。

或者更扎心的:AI 吭哧吭哧帮你干了 10 分钟活,你突然发现方向偏了,但已经晚了——它不会中途听你说话,你只能在心里默念一句"又白干了",然后敲 /stop 重来。

这两个场景,在过去一周内,同时被解决了。

八月初,AI 助手圈连着放了两颗卫星:Nous Research 发了 Hermes Agent v0.20「The Herald Release」,Open WebUI 发了号称"史上最大版本"的 v0.11.0。两个看起来不搭界的项目,更新方向却出奇地一致——让你的 AI 更像个"人",而不是一个"程序"。

以前的 AI 助手是工具,你要去迁就它;现在的 AI 助手是伙伴,它来迁就你。

一、你的 AI 终于能"听人话"了

Hermes 0.20 最大的变化,一句话就能说清楚:语音交互从"对讲机"变成了"打电话"。

以前 Hermes 的语音模式长什么样?你说一句,它思考完,把整段回复生成好,然后一次性念给你听。中间你插不上嘴,哪怕它完全理解错了你的意思,你也只能干等。就好像在用一个老式对讲机——说完还得加一句"over",然后等对方回。

现在不一样了。0.20 版支持实时对话式语音:AI 一边生成一边逐句朗读,你说"停,这里不对",它立刻停下来听你的纠正,然后调整当前这一轮的回复内容,继续往下说。

打个比方。你在厨房炒菜,手上全是油,想查一个配料比例。以前你得洗手、擦干、打字、等回复。现在你直接对着电脑喊一声——没错,"Hey Hermes"本地唤醒词也上线了——它被唤醒后,你说完问题,它边想边回答,你边说"加半勺就够了?"它马上回应"对,半勺,别多了"。

整个过程不用碰键盘,不用看屏幕,就像在跟一个站在旁边的人聊天。

真正的智能,不是替代你的思考,而是不打断你的生活。

更让人意外的是,这个语音能力不只停留在电脑前。Hermes 0.20 现在已经支持在微信、WhatsApp、飞书、钉钉、QQ 上发语音消息——AI 自动把语音转文字、生成回复、再转成语音发回来。你在地铁上对着微信发一句"帮我整理一下今天的会议纪要",过一会儿就能收到完整的整理结果。


二、做错了?说一声就行

第二个让我觉得"这才对嘛"的更新,叫中途修正

用 AI 干活的人一定都经历过这种绝望:你给了一个任务,它开始干了,干了七八步之后你发现——它从一开始就理解偏了。以前你只能 /stop 全丢掉重来,那感觉就像装修师傅已经贴完瓷砖了,你才说"不对,我要的是灰色不是白色"。

现在 0.20 支持在执行过程中直接输入纠正指令,不用 /stop,不用新建对话,当前的工作进度会被保留,AI 从你说的那一步调整方向继续干。你省了时间,它少做了无用功。


三、一个不够?叫一群来帮忙

Hermes 0.20 还做了一件对开发者来说很关键的事:正式支持 A2A v1.0 协议(Agent-to-Agent)。

翻译成人话就是:不同的 AI Agent 之间可以互相发现、互相通信、互相委托任务了。你主 Agent 接到一个大活,可以把子任务拆给不同的专业 Agent 去干,干完汇总回来。

比如你说"帮我写一个电商网站",主 Agent 自己写后端,同时把前端设计委托给另一个擅长 UI 的 Agent,把测试委托给第三个 Agent——三个同时开工,最后合在一起交给你。

这是社区最老的 issue(#514)终于关了,也意味着多 Agent 协作不再是小圈子里的黑科技,而是有了一个通用标准。


四、Open WebUI 0.11:不只是"长得更好看了"

说完 Hermes,再聊聊 Open WebUI。很多人把它当成 Hermes 的"脸"——你在网页上跟 AI 聊天的那个界面,就是 Open WebUI 提供的。这次 0.11 更新,官方用了一个词形容:"我们的最大版本"。

先说肉眼可见的:UI 全面重做。对话栏变窄了,字体更轻了,间距更整洁了。设置项终于按逻辑重新归了类,不用在几十个开关里翻半天找"那个在哪来着"。侧边栏悬停可以预览最近消息——不用点进去就能看到上次聊到哪了。

但真正的亮点藏在这些表面变化下面。

子代理——这个功能跟前面说的 A2A 异曲同工。你对着 Open WebUI 说话,它可以把复杂子任务派给后台的助手 Agent 独立执行,干完了再把结果汇报到主对话里。你看到的只是一个回复,但背后可能是三四个 Agent 同时在工作。

对话分支——任意一条历史消息,你都可以从那里"分叉"出一条新对话。想试试"如果刚才选了方案 B 会怎样"?从那个节点开个分支就行,不用删除重来。

仙踪问道提醒:升级到 0.11 之前务必备份数据库——这次有 schema 变更,如果你用的是多 worker 部署,必须同时升级,否则新老版本之间会报错。官方也明确说了,这是"建议尽快升级生产环境"的安全更新。

五、更快、更稳、更不容易罢工

两个版本在稳定性上的改进,虽然不那么性感,但用久了就知道有多重要。

Hermes 0.20 做了工具自愈:终端输出太长了自动溢出到文件,不会因为窗口爆掉而任务中断;patch 操作能识别已经应用的改动,不会重复造 bug;write_file 会校验落盘内容,写进去的就是正确的。默认迭代上限从 90 轮提到 500 轮——以前跑长任务动不动撞墙的情况,大幅减少。

Open WebUI 0.11 在性能上的提升也很实在:模型列表加载更快(去掉了内嵌头像数据),长回复流式输出更稳定(不会越写越慢),PostgreSQL 环境下对话搜索显著加速。开发团队甚至说可以考虑启用 ENABLE_ORJSON 来进一步加速 JSON 处理。

最好的工具,是让你忘了它在运行的那个。

六、这两个更新放在一起看,意味着什么?

把 Hermes 0.20 和 Open WebUI 0.11 放在一起打量,会发现一个清晰的趋势:

维度 过去的 AI 助手 现在的 AI 助手
交互方式 打字为主,语音是"朗读文字" 边听边打断,像真人对话
纠错方式 /stop 重来,当前工作全丢 中途纠正,保留进度
任务规模 一次干一件事 多 Agent 并行分工
界面体验 勉强能用 精心设计,追求爽感
稳定性 跑着跑着就挂了 自愈能力,长任务不中断
多平台 电脑前 微信/WhatsApp/QQ 语音消息

这不是某个功能的升级,而是一次定位的转变——AI 助手正在从"你需要学习的工具"变成"学习你的伙伴"。


如果你也想体验这些变化

两个项目都是开源的,自己部署需要一定的技术基础:配置 Python 环境、安装依赖、搞定国内网络加速、对接大模型 API……说实话,很多人在第一步就放弃了。

说到这里,如果你也想在自己的 Mac 上跑起这套系统,可以试试仙踪问道·爱马仕助手

它是 macOS 上的 Hermes Agent 本地部署专家,一键安装,自动搞定 Python 环境、国内网络加速、模型下载,连 Open WebUI 的安装和配置都帮你省了。支持 M1 到 M4 全系列 Apple Silicon 芯片,内置 oMLX 推理引擎让本地模型在 Mac 上跑得更快。更关键的是,它内置的 pi 智能诊断引擎能自动检测你的环境问题——依赖缺失、端口冲突、权限错误——一键修复,不用你自己翻论坛找解决方案。

欢迎访问官网使用,跑步进入AI新时代!


如果觉得有用,欢迎关注「仙踪问道」——每周分享 AI 工具实测和效率提升干货,不讲概念,只讲能落地的方法。

你用 AI 助手时最崩溃的一次经历是什么?是它理解错了你的意思,还是干到一半罢工了?评论区聊聊,说不定你的痛点下次更新就修了。

Read more