别让你的AI还活在打字时代——Hermes 0.20 和 Open WebUI 0.11 这波更新,把智能助手从"工具"推到了"伙伴"

简介: Hermes Agent v0.20 与 Open WebUI v0.11 同步升级:实现真正自然的语音交互、执行中实时纠错、多Agent协同分工,让AI从“工具”进化为“伙伴”。支持微信/WhatsApp等平台语音消息,Mac一键部署,更懂你、更稳定、更像人。

你有没有过这种体验——半夜躺在床上,脑子里突然冒出一个想法,想让 AI 帮你查点资料或者写段代码。但一想到还得爬起来打开电脑、敲字、等回复……算了,明天再说吧。

或者更扎心的:AI 吭哧吭哧帮你干了 10 分钟活,你突然发现方向偏了,但已经晚了——它不会中途听你说话,你只能在心里默念一句"又白干了",然后敲 /stop 重来。

这两个场景,在过去一周内,同时被解决了。

八月初,AI 助手圈连着放了两颗卫星:Nous Research 发了 Hermes Agent v0.20「The Herald Release」,Open WebUI 发了号称"史上最大版本"的 v0.11.0。两个看起来不搭界的项目,更新方向却出奇地一致——让你的 AI 更像个"人",而不是一个"程序"。

以前的 AI 助手是工具,你要去迁就它;现在的 AI 助手是伙伴,它来迁就你。

一、你的 AI 终于能"听人话"了

Hermes 0.20 最大的变化,一句话就能说清楚:语音交互从"对讲机"变成了"打电话"。

以前 Hermes 的语音模式长什么样?你说一句,它思考完,把整段回复生成好,然后一次性念给你听。中间你插不上嘴,哪怕它完全理解错了你的意思,你也只能干等。就好像在用一个老式对讲机——说完还得加一句"over",然后等对方回。

现在不一样了。0.20 版支持实时对话式语音:AI 一边生成一边逐句朗读,你说"停,这里不对",它立刻停下来听你的纠正,然后调整当前这一轮的回复内容,继续往下说。

打个比方。你在厨房炒菜,手上全是油,想查一个配料比例。以前你得洗手、擦干、打字、等回复。现在你直接对着电脑喊一声——没错,"Hey Hermes"本地唤醒词也上线了——它被唤醒后,你说完问题,它边想边回答,你边说"加半勺就够了?"它马上回应"对,半勺,别多了"。

整个过程不用碰键盘,不用看屏幕,就像在跟一个站在旁边的人聊天。

真正的智能,不是替代你的思考,而是不打断你的生活。

更让人意外的是,这个语音能力不只停留在电脑前。Hermes 0.20 现在已经支持在微信、WhatsApp、飞书、钉钉、QQ 上发语音消息——AI 自动把语音转文字、生成回复、再转成语音发回来。你在地铁上对着微信发一句"帮我整理一下今天的会议纪要",过一会儿就能收到完整的整理结果。


二、做错了?说一声就行

第二个让我觉得"这才对嘛"的更新,叫中途修正。

用 AI 干活的人一定都经历过这种绝望:你给了一个任务,它开始干了,干了七八步之后你发现——它从一开始就理解偏了。以前你只能 /stop 全丢掉重来,那感觉就像装修师傅已经贴完瓷砖了,你才说"不对,我要的是灰色不是白色"。

现在 0.20 支持在执行过程中直接输入纠正指令,不用 /stop,不用新建对话,当前的工作进度会被保留,AI 从你说的那一步调整方向继续干。你省了时间,它少做了无用功。


三、一个不够?叫一群来帮忙

Hermes 0.20 还做了一件对开发者来说很关键的事:正式支持 A2A v1.0 协议(Agent-to-Agent)。

翻译成人话就是:不同的 AI Agent 之间可以互相发现、互相通信、互相委托任务了。你主 Agent 接到一个大活,可以把子任务拆给不同的专业 Agent 去干,干完汇总回来。

比如你说"帮我写一个电商网站",主 Agent 自己写后端,同时把前端设计委托给另一个擅长 UI 的 Agent,把测试委托给第三个 Agent——三个同时开工,最后合在一起交给你。

这是社区最老的 issue(#514)终于关了,也意味着多 Agent 协作不再是小圈子里的黑科技,而是有了一个通用标准。


四、Open WebUI 0.11:不只是"长得更好看了"

说完 Hermes,再聊聊 Open WebUI。很多人把它当成 Hermes 的"脸"——你在网页上跟 AI 聊天的那个界面,就是 Open WebUI 提供的。这次 0.11 更新,官方用了一个词形容:"我们的最大版本"。

先说肉眼可见的:UI 全面重做。对话栏变窄了,字体更轻了,间距更整洁了。设置项终于按逻辑重新归了类,不用在几十个开关里翻半天找"那个在哪来着"。侧边栏悬停可以预览最近消息——不用点进去就能看到上次聊到哪了。

但真正的亮点藏在这些表面变化下面。

子代理——这个功能跟前面说的 A2A 异曲同工。你对着 Open WebUI 说话,它可以把复杂子任务派给后台的助手 Agent 独立执行,干完了再把结果汇报到主对话里。你看到的只是一个回复,但背后可能是三四个 Agent 同时在工作。

对话分支——任意一条历史消息,你都可以从那里"分叉"出一条新对话。想试试"如果刚才选了方案 B 会怎样"?从那个节点开个分支就行,不用删除重来。

仙踪问道提醒:升级到 0.11 之前 务必备份数据库——这次有 schema 变更,如果你用的是多 worker 部署,必须同时升级,否则新老版本之间会报错。官方也明确说了,这是"建议尽快升级生产环境"的安全更新。

五、更快、更稳、更不容易罢工

两个版本在稳定性上的改进,虽然不那么性感,但用久了就知道有多重要。

Hermes 0.20 做了工具自愈:终端输出太长了自动溢出到文件,不会因为窗口爆掉而任务中断;patch 操作能识别已经应用的改动,不会重复造 bug;write_file 会校验落盘内容,写进去的就是正确的。默认迭代上限从 90 轮提到 500 轮——以前跑长任务动不动撞墙的情况,大幅减少。

Open WebUI 0.11 在性能上的提升也很实在:模型列表加载更快(去掉了内嵌头像数据),长回复流式输出更稳定(不会越写越慢),PostgreSQL 环境下对话搜索显著加速。开发团队甚至说可以考虑启用 ENABLE_ORJSON 来进一步加速 JSON 处理。

最好的工具,是让你忘了它在运行的那个。

六、这两个更新放在一起看,意味着什么?

把 Hermes 0.20 和 Open WebUI 0.11 放在一起打量,会发现一个清晰的趋势:

维度 过去的 AI 助手 现在的 AI 助手
交互方式 打字为主,语音是"朗读文字" 边听边打断,像真人对话
纠错方式 /stop 重来,当前工作全丢 中途纠正,保留进度
任务规模 一次干一件事 多 Agent 并行分工
界面体验 勉强能用 精心设计,追求爽感
稳定性 跑着跑着就挂了 自愈能力,长任务不中断
多平台 电脑前 微信/WhatsApp/QQ 语音消息

这不是某个功能的升级,而是一次定位的转变——AI 助手正在从"你需要学习的工具"变成"学习你的伙伴"。


如果你也想体验这些变化

两个项目都是开源的,自己部署需要一定的技术基础:配置 Python 环境、安装依赖、搞定国内网络加速、对接大模型 API……说实话,很多人在第一步就放弃了。

说到这里,如果你也想在自己的 Mac 上跑起这套系统,可以试试仙踪问道·爱马仕助手。

它是 macOS 上的 Hermes Agent 本地部署专家,一键安装,自动搞定 Python 环境、国内网络加速、模型下载,连 Open WebUI 的安装和配置都帮你省了。支持 M1 到 M4 全系列 Apple Silicon 芯片,内置 oMLX 推理引擎让本地模型在 Mac 上跑得更快。更关键的是,它内置的 pi 智能诊断引擎能自动检测你的环境问题——依赖缺失、端口冲突、权限错误——一键修复,不用你自己翻论坛找解决方案。



如果觉得有用,欢迎关注「仙踪问道」——每周分享 AI 工具实测和效率提升干货,不讲概念,只讲能落地的方法。

你用 AI 助手时最崩溃的一次经历是什么?是它理解错了你的意思,还是干到一半罢工了?评论区聊聊,说不定你的痛点下次更新就修了。

相关文章
|
3月前
|
人工智能 前端开发 API
装了Hermes Agent三个月,我终于搞明白前端该怎么选了
本文对比Hermes两大使用方案:Open WebUI(方案A)侧重日常写作、图表渲染与团队共享;Hermes Desktop(方案B)专注Agent深度调教、技能管理与轻量部署。三类真实场景帮你对号入座,选最适合自己的那一套——或两者兼用,各司其职。
327 0
装了Hermes Agent三个月,我终于搞明白前端该怎么选了
|
2月前
|
存储 安全 调度
Agent 五大工程体系:Prompt、Context、Loop、Graph 与 Harness
本文提出Agent五大工程体系:Prompt(提示词)、Context(上下文)、Loop(循环)、Graph(图)与Harness(运行时),构建分层分析框架。聚焦控制对象——措辞、信息构成、时间节奏、空间结构与系统运营,助力开发者精准定位问题、理解Runtime本质,告别机制混淆。
444 1
|
5月前
|
人工智能 安全 数据安全/隐私保护
Hermes Agent 登顶 OpenRouter 调用量第一,Agentic AI 时代已不可逆转
2026年5月,Hermes Agent以日均2710亿Token调用量登顶OpenRouter榜首,超越OpenClaw。其核心优势在于“越用越聪明”的自学习架构、三层记忆系统、零CVE安全设计,以及抓住OpenClaw创始人离任的生态窗口期,10周获11万GitHub Stars,标志Agentic AI正式进入生产级应用时代。
856 2
|
消息中间件 Java 数据库连接
JMS 消息队列接口基本使用指南
JMS 消息队列接口基本使用指南
1327 0
|
2月前
|
人工智能 监控 IDE
阿里云百炼新人免费额度解析:免费额度、适用范围、领取教程及常见注意事项
本文梳理了阿里云百炼平台新人专属免费额度的核心规则与使用指南。免费额度面向新用户自动发放,每模型通常为100万Token,有效期90天,仅适用于华北2(北京)地域模型的实时推理调用,不支持Batch、调优、部署等场景。文章详细解读了额度查询的三种方式、主账号与RAM子账号共享规则、不同模型额度相互独立等关键特性。重点介绍了“免费额度用完即停”功能的开启与关闭逻辑,以帮助用户避免意外扣费。同时,针对“额度耗尽后如何继续使用”、“如何查看消耗记录”、“为何会产生费用”等十余个常见问题提供了清晰的解答,旨在帮助用户全面理解并充分利用此项福利,实现零成本入门与体验。
|
3月前
|
人工智能 自然语言处理 文字识别
阿里云通义千问大模型最新功能介绍
阿里云通义千问是通义实验室打造的全栈式大模型家族,覆盖通用对话、长文本处理、多模态理解、代码生成、智能体执行等全场景能力,形成从入门到旗舰的完整产品矩阵。最新迭代的Qwen3系列,以**百万级上下文、原生多模态、全链路智能体**为核心标签,彻底突破传统大模型“对话工具”的局限,转向**自主思考、工具调用、任务执行**的智能体时代。
3865 1
|
2月前
|
人工智能 缓存 API
阿里云百炼 Token Plan 个人版上线:39 元起订阅,抢先体验 Qwen3.8-Max-Preview
阿里云Token Plan个人版上线!最低39元/月,含Qwen3.8-Max-Preview(2.4T参数)等11个文本/图像/视频模型,支持联网搜索、多Agent并发及Harness工具,Credits统一计量,夜间调用低至0.2折。阿里云百炼Token Plan官网:https://t.aliyun.com/U/EsRjVx
340 2
|
3月前
|
存储 数据可视化 物联网
基于阿里云DataV的智慧园区能耗可视化大屏实践
本文介绍基于阿里云DataV的智慧园区能耗可视化方案:融合合众致达NB-IoT/Cat.1智能表计、IoT平台、Lindorm时序数据库与函数计算,实现零代码、积木式多角色大屏搭建。解决数据上云后决策难问题,支持物业、EHS、租户等差异化视图,5天快速上线,告警响应缩至90秒,投诉下降81%。(239字)
458 0
|
2月前
|
内存技术
阿里云千问模型前缀续写是什么?Partial Mode工作原理介绍
前缀续写(Partial Mode)指模型基于指定前缀无缝续生成内容。需将messages中最后一条设为assistant角色,content填前缀,并置"partial":true。支持Qwen-Max、Plus、Flash、Coder、VL、Turbo及Qwen3.5等系列(非思考模式)。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
|
2月前
|
存储 关系型数据库 BI
租赁电商系统全链路架构设计与实践 —— 基于阿里云生态本地化部署解决方案
本文介绍一套基于PHP8+Vue3开发的私有化租赁业务系统,支持本地部署,覆盖资产管控、多级分账、风控催收等租赁特有需求;深度集成阿里云,实现高可用、高安全架构,助力企业自主掌控数据与业务全链路。

热门文章

最新文章