ARTICLE DETAIL

建站实战干货

来自一线的建站与推广经验沉淀,每一条都经过真实交付验证。

Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来

2026/8/22 2:10:14 拓冰建站 浏览量
Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来 Grok Bot与Hermes表面越来越像 架构层却在押注完全不同的未来打开Grok Bot或Hermes Bot Mode界面上都是带名字、带角色、能记事、能连工具、能后台跑任务的AI队友。过去一周两边被反复放在一起比较理由看起来很充分都在把聊天变成派活。可真正拉开差距的从来不是你能建多少个Bot也不是界面上的群聊有多热闹。差距藏在执行发生在哪里、状态存在哪里、模型栈用户能控多少、可复用能力到底是什么、以及Agent被允许怎样与外部系统说话。产品层在趋同。架构层在做两种截然不同的长期赌注。我起初也顺着表面去比“谁Bot更多、谁记忆更强”。后来对照Cursor/SpaceXAI与Nous Research的第一方文档再亲手跑通一次Hermes的A2A实验后才看清一边在给你一台托管好的电脑另一边在给你一套可以自己摆放的运行时。托管电脑与可配置运行时 两种抽象层级的根本分叉Grok Bot的文档描述得很直白持久化Agent、连接插件、在云电脑里操作、记住上下文、跑例程、用户离开后继续工作。没有插件的服务就用云电脑上的浏览器。执行环境主要由产品提供。你建Agent、连服务、认证、描述结果剩下的底层机器大多交给托管环境。Hermes走的是几乎相反的方向。它开源、MIT许可能在Windows、macOS、Linux/WSL或Docker里原生跑。模型层可配置而不是绑死在单一提供商。核心抽象不是“一个有电脑的Bot”而是“一套你能自己配置组件的Agent运行时”——模型选择、工具、记忆、技能、Profile、网关、执行后端全部暴露。Grok Bot把Agent放进托管电脑。Hermes把运行时交给你让你放进自己控制的环境。这不是好坏判断只是抽象层级的选择。就像一个给你配好全套工具的现成工作室另一个给你一套可拆卸的机床让你决定放在哪间厂房、接哪条电源。Profile如何把“名字不同”变成真正的状态边界在Hermes里Profile是独立的home目录。每个Profile可以有自己的配置、API密钥、SOUL.md、记忆、会话、技能、定时任务、状态数据库和网关状态。两个Bot因此不必是同一个Agent换了个名字。你可以让一个Profile专门做研究研究向模型、网络访问、研究技能、独立记忆与状态另一个做实现编码向模型、终端与文件工具、不同技能与记忆。这比换头像或系统提示有意义得多。但官方文档也明确提醒状态隔离不等于执行隔离。Profile状态与终端工作目录是两回事。不同home不会自动给每个命令套上操作系统级沙箱。把每个Hermes Bot都叫“完全隔离”并不准确。模型自由不是功能清单上的勾选常见说法是“Grok用GrokHermes支持很多模型”。精神对但漏了更重要的架构点。Hermes把Agent与所用模型分开。配置系统有主模型槽位还有独立的辅助模型槽位分别处理压缩、视觉、网页摘要、审批打分、MCP路由、技能搜索。这些可以单独配置。Nous Portal目前列出300模型也支持直接提供商和本地端点。Agent身份不必等于模型身份。一个持久化研究Agent今天用一个模型明天换另一个它依然是那个Agent。不同Agent也可以按岗位分配不同模型。当前公开的Grok Bot文档里我没找到对等的、面向用户的模型路由层。这不证明Grok Bot内部不能用不同模型只说明Hermes把模型选择暴露成了操作员可控的原语而Grok Bot目前把这一层抽象得更远。真正的长期资产可能是技能库 而不是对话历史两边都指向同一方向的大转移有用的Agent不该每次从零重新发现工作流。Hermes把Skills当作可复用的程序性知识支持可安装能力与明确的技能工件并对第三方技能安装做了安全扫描。Grok Bot的公开文档强调持久化Agent、插件与能跨会话继续工作的例程。实现不同方向相似成功行为应该变成可复用行为。比“谁记忆更好”更有意思的问题是——如果Agent智能的耐久单位最终不是对话历史而是它知道如何调用的有用程序库呢围绕Agent Skills的竞争才会真正变得关键。A2A如何改写“多Agent”的含义这是我亲手测过的部分。Hermes实现了开放的Agent2Agent协议v1.0。文档写明Hermes Agent既能调用外部A2A对等体也能接收来自它们的任务。互操作不限于另一个Hermes实例兼容LangChain、CrewAI、Google ADK以及基于官方A2A SDK的实现。这打开了完全不同的可能不是产品内部的Agent A → Agent B而是Hermes → 另一个进程 → 另一台机器 → 另一个框架交接发生在协议边界。官方也提醒A2A主要推荐用于跨进程、跨机器或跨框架。同一台机器上的多个Agent很多时候用更简单的原生委托或看板式工作队列就够。我故意在Bot Mode里把一个工作流拆成三个故意不完整的角色Research Intelligence 能协调但不实现↓Implementation Engineer 能构建但不负责审批自己的工作↓Verification Auditor 能独立测试结果第一次消息没有魔法般成功。A2A对等体最初需要配置一条早期消息因为结构问题被拒为空任务。修正后Implementation Engineer回了PONG_OK确认通信通了。真正规格被交接过去Implementation Engineer产出了Python Capability Risk Inspector结果交给Verification Auditor。Auditor跑了十个测试包括正常组合、边界与对抗用例。全部通过。有趣的不是那个工件而是通信本身成了职责分离的一部分。这些Agent之所以一起有用恰恰因为没有一个被设计成拥有整个工作流。这和把几个Bot扔进同一个聊天室是完全不同的思路。开放互操作与产品原生协作不是一回事Grok Bot明显围绕多个持久化AI队友与真实工具使用来设计。但我没有找到公开文档证明它有与Hermes A2A对等的开放外部Agent间互操作层。这不代表内部不存在也不代表永远不会有。只是今天可验证的差异更窄Hermes公开暴露基于标准的A2A互操作Grok Bot的文档优势在于围绕持久化Agent、插件、浏览器使用与例程的托管产品环境。够清楚不必发明更强的对立。安全边界在移动 而不是消失Grok Bot的Agent能作用于真实账号、文件和网站。Cursor明确警告这种权限建议用户自己登录Grok Bot电脑并警告不要把API密钥和凭证放在普通聊天或文件里。Hermes让操作员对执行位置与状态分离有更多控制但也增加了配置责任。不同Profile并不自动等于不同操作系统级沙箱。A2A层因此内置了明确安全控制默认无localhost、按对等体认证、入站消息的提示注入过滤、出站凭证脱敏、速率限制与审计相关身份处理。结论不是一边天生安全、一边天生不安全。而是它们把信任放在系统的不同部分。Grok Bot把更多安全责任集中在托管产品里Hermes让更多安全边界由操作员配置——控制更多也更容易配错。定价不是简单的“300美元对免费”截至2026年8月20日Cursor文档写明个人持续使用Grok Bot包含在Cursor Ultra里。Pro和Pro Plus不含合格的团队席位是另一条路径。Cursor Ultra目前200美元/月。SuperGrok Heavy订阅者有一个访问促销符合条件的用户获得一个月免费Cursor Ultra但不会因为继续订SuperGrok Heavy而重复赠送。所以“Grok Bot每月300美元”并不准确。更准确的说法是个人用户目前通过200美元/月的Cursor Ultra订阅获得访问另有其他合格路径。Hermes Agent本身是0美元软件、开源、MIT。但运行它并不免费。你仍需要执行环境和某种模型推理——现有电脑、VPS、本地模型硬件、API用量、OpenRouter、Nous Portal或其他提供商。成本曲线完全不同没有强制软件许可费但基础设施与推理成本由用户选择、随工作负载变化。对某些人可以极便宜对另一些人可能更复杂甚至更贵。没有指定工作负载和模型栈就没有诚实的“Hermes成本”单一数字。我真正会用的对比维度维度Grok Bot当前可验证特征Hermes当前可验证特征执行环境产品提供的托管云电脑用户可控的运行时本地/Docker/SSH等状态边界账号级共享云电脑与会话Profile级独立home目录与配置模型控制更多抽象在产品内部主模型辅助模型槽位可独立配置可复用能力插件、例程、持久化Agent可安装Skills与安全扫描多Agent通信产品内群聊与协调公开A2A协议跨框架/跨机器安全责任更多集中在托管产品更多由操作员配置成本结构捆绑在200美元/月Cursor Ultra等软件免费基础设施与推理自选两边都在优化“AI队友”的不同定义。Grok Bot在做产品赌注给Agent一台持久电脑连上用户工作环境保持可用并尽量藏起基础设施。Hermes在做运行时赌注让操作员选择模型、执行环境、状态边界、工具、技能甚至越来越多地选择Agent通信协议。更简单地说Grok Bot试图去掉操作摩擦Hermes试图去掉架构锁定。想派真实工作、又不想自己运营Agent栈的人Grok Bot的路径可能正好对。想组合Agent、换模型、检查状态、控制能力、并跨开放边界连接Agent的人Hermes会有趣得多。市场最终不必只选一种哲学。界面可能继续收敛两边都看起来像一排等待派活的AI队友。可名单不是架构。当这些Agent开始持有凭证、控制电脑、积累技能、委托权限并把任务发给其他Agent时界面底下坐着什么才会成为产品最重要的部分。你现在更在意去掉操作摩擦还是去掉架构锁定如果已经同时试过两边哪一层的差异真正影响了你的日常工作流我是紫微AI在做一个「人格操作系统ZPF」。后面会持续分享AI Agent和系统实验。感兴趣可以关注我们下期见。