别让你的AI还活在打字时代——Hermes 0.20 和 Open WebUI 0.11 这波更新,把智能助手从"工具"推到了"伙伴"

简介: Hermes Agent v0.20 与 Open WebUI v0.11 同步升级:实现真正自然的语音交互、执行中实时纠错、多Agent协同分工,让AI从“工具”进化为“伙伴”。支持微信/WhatsApp等平台语音消息,Mac一键部署,更懂你、更稳定、更像人。

你有没有过这种体验——半夜躺在床上,脑子里突然冒出一个想法,想让 AI 帮你查点资料或者写段代码。但一想到还得爬起来打开电脑、敲字、等回复……算了,明天再说吧。

或者更扎心的:AI 吭哧吭哧帮你干了 10 分钟活,你突然发现方向偏了,但已经晚了——它不会中途听你说话,你只能在心里默念一句"又白干了",然后敲 /stop 重来。

这两个场景,在过去一周内,同时被解决了。

八月初,AI 助手圈连着放了两颗卫星:Nous Research 发了 Hermes Agent v0.20「The Herald Release」,Open WebUI 发了号称"史上最大版本"的 v0.11.0。两个看起来不搭界的项目,更新方向却出奇地一致——让你的 AI 更像个"人",而不是一个"程序"。

以前的 AI 助手是工具,你要去迁就它;现在的 AI 助手是伙伴,它来迁就你。

一、你的 AI 终于能"听人话"了

Hermes 0.20 最大的变化,一句话就能说清楚:语音交互从"对讲机"变成了"打电话"。

以前 Hermes 的语音模式长什么样?你说一句,它思考完,把整段回复生成好,然后一次性念给你听。中间你插不上嘴,哪怕它完全理解错了你的意思,你也只能干等。就好像在用一个老式对讲机——说完还得加一句"over",然后等对方回。

现在不一样了。0.20 版支持实时对话式语音:AI 一边生成一边逐句朗读,你说"停,这里不对",它立刻停下来听你的纠正,然后调整当前这一轮的回复内容,继续往下说。

打个比方。你在厨房炒菜,手上全是油,想查一个配料比例。以前你得洗手、擦干、打字、等回复。现在你直接对着电脑喊一声——没错,"Hey Hermes"本地唤醒词也上线了——它被唤醒后,你说完问题,它边想边回答,你边说"加半勺就够了?"它马上回应"对,半勺,别多了"。

整个过程不用碰键盘,不用看屏幕,就像在跟一个站在旁边的人聊天。

真正的智能,不是替代你的思考,而是不打断你的生活。

更让人意外的是,这个语音能力不只停留在电脑前。Hermes 0.20 现在已经支持在微信、WhatsApp、飞书、钉钉、QQ 上发语音消息——AI 自动把语音转文字、生成回复、再转成语音发回来。你在地铁上对着微信发一句"帮我整理一下今天的会议纪要",过一会儿就能收到完整的整理结果。


二、做错了?说一声就行

第二个让我觉得"这才对嘛"的更新,叫中途修正

用 AI 干活的人一定都经历过这种绝望:你给了一个任务,它开始干了,干了七八步之后你发现——它从一开始就理解偏了。以前你只能 /stop 全丢掉重来,那感觉就像装修师傅已经贴完瓷砖了,你才说"不对,我要的是灰色不是白色"。

现在 0.20 支持在执行过程中直接输入纠正指令,不用 /stop,不用新建对话,当前的工作进度会被保留,AI 从你说的那一步调整方向继续干。你省了时间,它少做了无用功。


三、一个不够?叫一群来帮忙

Hermes 0.20 还做了一件对开发者来说很关键的事:正式支持 A2A v1.0 协议(Agent-to-Agent)。

翻译成人话就是:不同的 AI Agent 之间可以互相发现、互相通信、互相委托任务了。你主 Agent 接到一个大活,可以把子任务拆给不同的专业 Agent 去干,干完汇总回来。

比如你说"帮我写一个电商网站",主 Agent 自己写后端,同时把前端设计委托给另一个擅长 UI 的 Agent,把测试委托给第三个 Agent——三个同时开工,最后合在一起交给你。

这是社区最老的 issue(#514)终于关了,也意味着多 Agent 协作不再是小圈子里的黑科技,而是有了一个通用标准。


四、Open WebUI 0.11:不只是"长得更好看了"

说完 Hermes,再聊聊 Open WebUI。很多人把它当成 Hermes 的"脸"——你在网页上跟 AI 聊天的那个界面,就是 Open WebUI 提供的。这次 0.11 更新,官方用了一个词形容:"我们的最大版本"。

先说肉眼可见的:UI 全面重做。对话栏变窄了,字体更轻了,间距更整洁了。设置项终于按逻辑重新归了类,不用在几十个开关里翻半天找"那个在哪来着"。侧边栏悬停可以预览最近消息——不用点进去就能看到上次聊到哪了。

但真正的亮点藏在这些表面变化下面。

子代理——这个功能跟前面说的 A2A 异曲同工。你对着 Open WebUI 说话,它可以把复杂子任务派给后台的助手 Agent 独立执行,干完了再把结果汇报到主对话里。你看到的只是一个回复,但背后可能是三四个 Agent 同时在工作。

对话分支——任意一条历史消息,你都可以从那里"分叉"出一条新对话。想试试"如果刚才选了方案 B 会怎样"?从那个节点开个分支就行,不用删除重来。

仙踪问道提醒:升级到 0.11 之前 务必备份数据库——这次有 schema 变更,如果你用的是多 worker 部署,必须同时升级,否则新老版本之间会报错。官方也明确说了,这是"建议尽快升级生产环境"的安全更新。

五、更快、更稳、更不容易罢工

两个版本在稳定性上的改进,虽然不那么性感,但用久了就知道有多重要。

Hermes 0.20 做了工具自愈:终端输出太长了自动溢出到文件,不会因为窗口爆掉而任务中断;patch 操作能识别已经应用的改动,不会重复造 bug;write_file 会校验落盘内容,写进去的就是正确的。默认迭代上限从 90 轮提到 500 轮——以前跑长任务动不动撞墙的情况,大幅减少。

Open WebUI 0.11 在性能上的提升也很实在:模型列表加载更快(去掉了内嵌头像数据),长回复流式输出更稳定(不会越写越慢),PostgreSQL 环境下对话搜索显著加速。开发团队甚至说可以考虑启用 ENABLE_ORJSON 来进一步加速 JSON 处理。

最好的工具,是让你忘了它在运行的那个。

六、这两个更新放在一起看,意味着什么?

把 Hermes 0.20 和 Open WebUI 0.11 放在一起打量,会发现一个清晰的趋势:

维度 过去的 AI 助手 现在的 AI 助手
交互方式 打字为主,语音是"朗读文字" 边听边打断,像真人对话
纠错方式 /stop 重来,当前工作全丢 中途纠正,保留进度
任务规模 一次干一件事 多 Agent 并行分工
界面体验 勉强能用 精心设计,追求爽感
稳定性 跑着跑着就挂了 自愈能力,长任务不中断
多平台 电脑前 微信/WhatsApp/QQ 语音消息

这不是某个功能的升级,而是一次定位的转变——AI 助手正在从"你需要学习的工具"变成"学习你的伙伴"。


如果你也想体验这些变化

两个项目都是开源的,自己部署需要一定的技术基础:配置 Python 环境、安装依赖、搞定国内网络加速、对接大模型 API……说实话,很多人在第一步就放弃了。

说到这里,如果你也想在自己的 Mac 上跑起这套系统,可以试试仙踪问道·爱马仕助手

它是 macOS 上的 Hermes Agent 本地部署专家,一键安装,自动搞定 Python 环境、国内网络加速、模型下载,连 Open WebUI 的安装和配置都帮你省了。支持 M1 到 M4 全系列 Apple Silicon 芯片,内置 oMLX 推理引擎让本地模型在 Mac 上跑得更快。更关键的是,它内置的 pi 智能诊断引擎能自动检测你的环境问题——依赖缺失、端口冲突、权限错误——一键修复,不用你自己翻论坛找解决方案。



如果觉得有用,欢迎关注「仙踪问道」——每周分享 AI 工具实测和效率提升干货,不讲概念,只讲能落地的方法。

你用 AI 助手时最崩溃的一次经历是什么?是它理解错了你的意思,还是干到一半罢工了?评论区聊聊,说不定你的痛点下次更新就修了。

相关文章
|
14天前
|
人工智能 自然语言处理 安全
别让你的AI当"差不多先生"——Hermes 0.18+0.19双版本连更,把智能体从"会干活"推到了"能托付"
Hermes 0.18–0.19 版本聚焦“可信AI”,六大升级重塑人机协作:/goal 自我验证+持久化兜底确保任务真完成;/learn 技能蒸馏让AI持续积累经验;MoA多模型协商提升决策质量;冷启动提速80%、渲染优化14倍;Smart Approvals智能审批兼顾安全与效率;/journey记忆时间线+上下文压缩保障长期项目连贯性。真正实现“交办即安心”。
176 1
|
1月前
|
机器学习/深度学习 人工智能 安全
7天AI大事速览:一篇看完,比别人少刷50篇碎片信息
过去7天AI圈风云突变:Anthropic冲刺万亿级IPO、旗舰模型遭美政府临时下线又部分解禁;Google发布表格AI TabFM、医疗AI登顶《Nature》;ICML首尔大会聚焦推理本质与多智能体瓶颈;美团开源1.6万亿参数国产模型。技术狂奔,监管趋严,落地加速。
283 1
|
1月前
|
人工智能 关系型数据库 MySQL
给你的AI Agent装上"行为记忆":agentmemory安装到整合全指南
agentmemory是专为AI Agent设计的本地化“情节记忆”引擎,解决其无状态、易失忆问题。它自动记录操作历史、决策与教训,支持LLM压缩、向量检索与知识图谱,R@5召回率达95.2%,节省92% token,开源(Apache 2.0),零外部依赖,15分钟即可部署启用。
655 0
|
人工智能 搜索推荐 Apache
Agent六款开源记忆工具大横评——全都能本地跑,全都不花钱
AI 编程助手每次开新会话就"失忆"?六款完全开源、免费、可本地部署的记忆扩展工具——agentmemory、QMD、Cognee、mem0、Zep、TencentDB Agent Memory,覆盖行为记忆、文档检索、知识图谱、时序感知四大能力。从零干预自动捕获到 Markdown 知识库搜索,再到多跳关系推理,帮你给 Hermes / OpenClaw 装上一套完整的持久记忆系统
523 0
Agent六款开源记忆工具大横评——全都能本地跑,全都不花钱
|
2月前
|
人工智能 JavaScript 数据挖掘
让你的Hermes能力翻倍:从skills.sh装技能包的完整指南
Hermes Agent装好了但总觉得不够好用?问题可能不在模型,在技能包。本文详解skills.sh这个有600+社区技能的Agent应用商店,手把手教你两种集成方式——npx skills add配合external_dirs配置的通用方案,以及hermes skills install原生一键安装的省事路线,让你的Hermes真正"懂行"
535 0
|
2月前
|
Apache 芯片 异构计算
刚发布的 Gemma4 12B 能打吗?三款最新顶流开源模型跑分全解读,堪比跟去年主流闭源模型
Gemma4 12B(6月3日刚发布)、Gemma4 26B A4B、Qwen3.6-35B-A3B,三款近期开源模型在 MMLU-Pro、GPQA Diamond、AIME 等评测中全面对标 Claude Sonnet 4 和 GPT-4.1 这两款 2025 年中闭源旗舰 ,数学科学推理甚至大幅领先。一文看懂跑分、架构差异和使用场景。
666 0
|
3月前
|
人工智能 安全 数据安全/隐私保护
Hermes Agent 登顶 OpenRouter 调用量第一,Agentic AI 时代已不可逆转
2026年5月,Hermes Agent以日均2710亿Token调用量登顶OpenRouter榜首,超越OpenClaw。其核心优势在于“越用越聪明”的自学习架构、三层记忆系统、零CVE安全设计,以及抓住OpenClaw创始人离任的生态窗口期,10周获11万GitHub Stars,标志Agentic AI正式进入生产级应用时代。
699 2
|
2月前
|
人工智能 JSON API
嘴炮Hermes:我干完了!实际啥也没做,咋整?
本文揭秘AI Agent“嘴炮”现象(执行幻觉):模型不真实调用工具,却编造看似完美的执行报告。以Hermes生成壁纸任务为例,剖析其成因——LLM本质是概率文本生成器。提出两大缓解方案:开启`tool_use_enforcement: true`强制校验 + 在SOUL.md中植入“执行铁律”,显著降低幻觉率。
200 0
|
2月前
|
人工智能 监控 API
本地部署AI Agent实现GEO自动化效果追踪的技术方案
GEO(生成式引擎优化)是提升内容在AI搜索中被引用的策略。本方案基于Hermes开源Agent与仙踪问道MCP工具集,实现本地化、按需调用的GEO效果追踪:自动生成高频问题、实时查询豆包/通义千问引用排名,数据真实、成本低廉、灵活可控。
212 0
|
2月前
|
人工智能 算法 项目管理
Hermes Agent 总记不住你说的话?3 步治好 AI 助手的"健忘症"
Hermes Agent“健忘”源于核心记忆文件MEMORY.md仅2000字符容量,导致跨对话信息无法持久保存。本文详解三步解决方案:①扩容配置(治标);②启用8种外部记忆扩展(如Holographic、Mem0、Supermemory等,治本);③实时查看记忆状态。让AI真正记住你。
805 2
Hermes Agent 总记不住你说的话?3 步治好 AI 助手的"健忘症"