8月3日,AI Agent圈同时发生了两件事。
Nous Research 发布了 Hermes Agent v0.20.0,代号"The Herald Release"(传令神版),单版本合并约1400个PR、3650次提交、650+贡献者参与。同一天,阿里巴巴正式发布 Qwen3.8,总参数量2.4万亿,编程能力全球第四。更引人注目的是,Qwen3.8在独立编程16天后,自己"搓"出了一个 Hermes Agent 级别的自进化智能体框架"oh-my-cli"。
两个项目,同一个方向:AI Agent 正在从工具变成基础设施。
Hermes Agent v0.20 最直观的变化是语音交互。
以前的模式被官方称为"语音留言互发"——你说完,等它生成完一整段回复,再听一个音频文件。想打断?没门。
v0.20 改成流式输出:AI 边生成边逐句朗读,你随时开口打断,它立刻停,切换到倾听状态。还支持本地唤醒词,比如"hey Hermes",检测完全在本地完成,音频不外传。
这个变化看起来不大,但意义很关键。AI Agent 的交互方式从"提交任务-等待结果"变成了"对话式协作",用户可以在执行过程中实时纠正方向,而不必等任务跑完再重来。
同时,WhatsApp、LINE、QQ、飞书等平台都支持了语音消息转录与回复。Hermes 在这些渠道上不再是纯文字 bot,而是可以接收和发送语音的 AI Agent。
另一个核心升级是 A2A v1.0 协议(Agent-to-Agent)。
Google 在 2024 年底推出了 A2A 协议,2025 年 12 月华为在 HarmonyOS 6 上实现了商用落地,今年 7 月已经有超过 150 家组织支持该协议。A2A 的本质是让不同 AI Agent 之间能互相发现、协商任务、交换结果,而不需要人类居中协调。
Hermes Agent v0.20 的 A2A 实现,意味着你可以启动多个 Hermes 实例,一个负责搜索、一个负责代码执行、一个负责用户界面,主 Agent 负责调度和汇总。
当然,A2A v1.0 还处在早期阶段。要真正发挥多智能体协同的效果,各个节点的工具调用能力和上下文共享机制需要额外的工程设计。这不是开箱即用的"几个 Agent 自动协作",而是提供了一套协议和 SDK,开发者来决定怎么组网。
同一天发布的 Qwen3.8,展示了另一种进化路径。
总参数量 2.4 万亿,激活 95B,支持 1M Tokens 长上下文。在 CodeArena 编程榜单中位居全球第四。
最让人意外的不是参数规模,而是一个实验:给 Qwen3.8 一句指令"创建一个自进化的智能体 Harness",让它从零开始自主编程。
16 天后,Qwen3.8 交付了一个 Hermes Agent 级别的自进化智能体框架"oh-my-cli",完整过程公开保存在 GitHub 上。
这不是简单的代码生成。Qwen3.8 在16天里自主完成了需求分析、架构设计、编码实现、测试调试、迭代优化的完整软件开发流程。过程中,它还通过钉钉接收了人类工程师的新需求,并据此调整了输出。
这意味着什么?
AI 大模型正在从"写代码的工具"变成"写 AI 的工具"。
阿里官方称这种能力为"循环工程"(Loop Engineering)——模型自己编排任务、领取执行、反馈迭代,人类工程师只需要提出初始需求和验收标准。
Hermes Agent 和 Qwen3.8 代表了 AI Agent 发展的两条路径。
Hermes 是从 Agent 框架出发,逐步增强语音、多智能体、工具调用等能力,目标是让 Agent 更像一个持续在线的"数字同事"。它的优势是开源、可本地部署、支持 200+ 模型,社区活跃,版本迭代节奏稳定(约两周一个命名版本)。
Qwen3.8 是从大模型出发,通过提升模型的自主编程和长周期任务执行能力,让模型本身就能"长出" Agent 框架。它的优势是单模型能力极强,2.4 万亿参数、1M 上下文、全球第四的编程能力,且价格远低于竞品(输入价格仅为 Opus 5 的 40%)。
两条路径的共同结论是:AI Agent 正在从"帮人类干活的工具"变成"能自己定义和执行任务的基础设施"。
从 Hermes Agent 的语音打断、A2A 多智能体协作,到 Qwen3.8 的16天自主编程,都在指向同一个方向:未来的 AI Agent 不再只是等待指令的执行者,而是能够理解目标、拆解任务、协调资源、交付结果的自主系统。
对于开发者来说,这意味着工作方式的根本转变。
你不需要学习一套新的 Agent 框架来干活,你需要学会的是:如何提出清晰的目标,如何验收成果,如何在 Agent 执行过程中进行关键节点的纠偏。
AI Agent 的竞争,已经从"谁的模型更聪明"转向"谁能更稳定地把任务做完"。
Hermes Agent v0.20 对现有用户是个重大升级,但有几个实际考量:
工具调用上限从 90 提升到 500,意味着复杂任务不再被硬截断,但实际消耗取决于任务复杂度,建议配合 Token 预算管理使用。
语音功能默认不开启,需要手动配置 STT 端点。
A2A 协议层已就位,但需要对端也实现 A2A 兼容才能使用,目前最适合的验证方式是启动两个 Hermes 实例进行本地测试。
Qwen3.8 的 API 已经上线,价格极具竞争力,但 Max 版本预计下周才开源,短期适合 API 调用,长期开源后本地部署成本会进一步降低。
无论选择哪条路径,AI Agent 正在快速脱离"尝鲜工具"的阶段,进入"生产级基础设施"的门槛。 对于已经在用 OpenClaw、Hermes 或 Claude Code 的团队来说,这次更新值得认真评估。
---
本文综合了博客园 vibecodinghuanzhe 的 Hermes Agent v0.20.0 全解、搜狐/钱江晚报的 Qwen3.8 发布报道、腾讯云的 Hermes Agent 介绍,以及百度百科关于 A2A 协议的解析。
*请认真填写需求信息,我们会在24小时内与您取得联系。