[控场AI]
· 7 分钟阅读· 3,988 字

Hermes AI员工搭建全指南:从Claude Code部署到自动运营社媒

Hermes AI员工搭建全指南:从Claude Code部署到自动运营社媒

Hermes 是可通过 Claude Code 一键部署的开源 AI 智能体框架,但真正难点在于让它持续产出价值。

本文介绍了如何搭建 Hermes AI 智能体框架,作者以自己运行的"Bob"为例——它管理广告账户、处理多平台私信、执行35个全天候定时任务。技术栈上,推荐用 Hetzner 替代 Hostinger 等主机商(月费约4~6美元,性价比更高),以 GitHub + Supabase + Composio 构成三层基础设施,用 Unipile 弥补 Composio 在社交私信场景的短板,用 Doppler 集中管理密钥。整个部署过程通过 Claude Code 自然语言指令完成,无需手动登录服务器或仪表盘。文章最诚实的结论是:安装本身极其简单,但把 AI 智能体打磨成真正能干活的"员工",需要对技能、工具和规则进行长达数月的反复迭代。

Hermes 到底是什么,为什么值得搭建

Hermes 是目前颇受关注的 AI 智能体框架,本质上是一个可以免费安装的 GitHub 仓库。当你把 Claude Code(云代码)指向这个仓库,它就能自动完成安装并启动一个可视化仪表盘,让你看到文件、模型和定时任务的运行情况。

创作者 LeeJNJ(经营多家八位数规模的软件与代理公司)展示了他名为 "Bob" 的 Hermes 智能体:它管理广告账户、在社交媒体发帖、回复评论,甚至处理 Instagram 和 LinkedIn 上的所有私信。这个 Bob 运行在一台 Mac mini 上,实时执行 35 个全天候定时任务,从晨间简报、每日回顾、日历预览到社交报告一应俱全。

值得强调的核心理念是:你几乎从不需要登录 Hermes 的仪表盘。所有的配置、调试、新增技能与定时任务,都通过你日常使用的 Claude Code 终端来完成。

Claude Code 是 Anthropic 推出的命令行 AI 编程助手,能够直接读写本地文件、执行终端命令、调用外部 API,相当于一个可以操作真实计算机环境的 AI 代理。它与普通聊天式 AI 的核心区别在于"工具调用"能力——不只是给出代码建议,而是真正执行操作。正是这一特性让它能够自动读取 GitHub 仓库、SSH 登录远程服务器、配置环境变量并启动服务,把原本需要开发者手动完成的部署流程压缩为几条自然语言指令。Hermes 框架的易用性在很大程度上依赖于 Claude Code 的这种"代理执行"能力,而非框架本身的技术复杂度。

用 Hetzner 部署,而非主机商的"便利陷阱"

市面上大量赞助视频教你在 Hostinger 这类平台一键搭建 Hermes,但作者指出这背后有坑:为了追求便捷,你拿到的往往是一台性能极弱、且由平台控制的服务器,长期运行成本反而更高。

他推荐的方案是 Hetzner——开发者常用的虚拟服务器平台,价格每台每月约 4~6 美元(欧元),无年度合同,可随时以最低成本升级配置。很多公司其实只是转售 Hetzner 并加价。

操作路径也很简单:

获取 API 令牌

  • 在 Hetzner 注册账户并填入账单信息
  • 进入默认项目 → 设置 → 安全 → API 令牌
  • 创建令牌后交给 Claude Code

拿到令牌后,把 Claude Code 指向 Hetzner 的 API 文档,直接告诉它:"我要搭建一个 Hermes 代理,这是 GitHub 仓库,这是我的 Hetzner 密钥"。它会自动挑选适合 Hermes 优化的服务器配置、设置 SSH 密钥,并登录服务器完成安装。作者演示中用的是 8GB 内存的服务器,比多数主机商提供的强得多。

因为这是登录到运行Hermes代理的虚拟服务器

把 AI 当"真正的员工"来配置

作者的核心建议是:把智能体当成真实的团队成员对待。为 Bob 单独准备了 Gmail 账号、电话号码和 Slack 账号,让它以独立身份完成所有任务——这样你能清楚知道每个动作的来源,出问题时也便于修复。

在此基础上,一个高效 Hermes 需要三层基础设施:

  • GitHub 仓库:用于向智能体推送代码、技能和更新(作者的仓库名为 Bob Command Center)
  • Supabase 后端:免费,让智能体拥有记忆,能记住代码与更新
  • Composio:免费的工具集成平台,内置 GitHub、Supabase、Google Calendar、Slack、Zoom、QuickBooks 等大量集成

Composio 的价值在于省去了自建开发者应用、管理各种密钥的繁琐流程。你只需点击"连接",即可把这些工具接入智能体,甚至可以同步多个账户(作者接入了 5 个不同的 Gmail 账号)。

我其实是通过

此外,作者还提到用 Doppler 集中管理 API 令牌,避免反复把密钥粘贴进 AI 对话里导致"密钥泄露、需轮换"的问题;Doppler 可连接 Vercel,把密钥分发到所有应用前端。

Supabase 是基于 PostgreSQL 的开源后端即服务(BaaS)平台,提供数据库、身份认证、实时订阅和文件存储等功能,免费层对个人项目足够用。在 Hermes 的架构中,它扮演的角色类似于智能体的"长期记忆":AI 每次执行任务后可以把结果、上下文和历史记录写入 Supabase,下次运行时再读取,从而突破大语言模型单次对话的上下文窗口限制。没有持久化存储,智能体每次启动都是"失忆状态",无法积累经验或跨任务保持一致性。Composio 则是一个专门为 AI 代理设计的工具集成中间层,它预先处理了 OAuth 授权、令牌刷新、API 格式适配等繁琐问题,让开发者只需点击连接而无需手动管理各平台的开发者应用和密钥。

突破社交媒体自动化的关键:Unipile

Composio 虽然覆盖了大部分基础需求,但它有一个明显短板——社交媒体的私信与评论。比如 Instagram 的连接质量不佳,回复超过 24 小时的私信、给别人帖子评论等操作,Composio 都难以胜任,只能靠不稳定的浏览器自动化。

作者的解决方案是 Unipile:它以独特方式维护对社交平台的 API 连接,价格极低(按账户计费)。无论是回复 LinkedIn 私信、Instagram 超时私信,还是连接 WhatsApp、Facebook Messenger、Telegram 和各类邮箱,Unipile 都能统一管理。它最擅长的正是私信和评论回复这类"没有其他好方案"的场景。

LinkedIn账户里的私信

至于发帖,作者用的是 Upload Post 工具来同步快拍、Instagram、Facebook、X 等渠道;图像和视频生成则通过 Composio 里的 4A(Fal.ai)集成实现。

通信方式与大语言模型的选择

如何与智能体对话? Hermes 支持 Telegram、Discord、Slack、WhatsApp 等多种频道。对大多数人来说 Telegram 最简单:通过 BotFather 发送 /newbot 命令,几步即可创建机器人并拿到令牌,再把令牌交给 Claude Code 与 Hermes 同步即可。

如果想用 iMessage 又没有 Mac mini,作者推荐 Photon Codes——它能让 AI 代理通过 iMessage 与你对话,且提供免费方案和免费号码。

我有一个简短的命令

用什么模型驱动? 作者的 Bob 跑在每月 200 美元的满配 Codex 方案上,但他坦言普通用户完全不需要——20 美元的 ChatGPT 订阅就能流畅运行,且几乎不会用完额度。此外也可通过 Anthropic API 密钥或 OpenRouter 账号接入任意模型(包括更便宜的开源模型)。他最推荐的方式是直接和 ChatGPT 订阅同步,体验最无缝。

作者还建议在 Claude Code 里设置一个类似 /Bob/Hermes 的快捷命令,让它自动用保存的凭据 SSH 进入服务器操作智能体——从此彻底告别登录 VPS 和仪表盘。

真正难的部分:让智能体自我改进

作者反复强调:搭建是最简单的部分,让它盈利和有用才是难点。他分享了一个自我改进机制:让智能体每天晚上工作结束后,回顾过去 24 小时的所有消息,找出可以优化的地方以提升第二天的成果。

一个真正好用的 AI 系统由三样东西协同构成:

  • 技能(Skills):精炼的提示词、边缘情况处理和规则
  • 工具(Tools):能访问什么、如何正确使用
  • 规则(Rules):"如果这样就那样"的逻辑判断

作者的 Bob 之所以能运营广告账户,靠的并不是那些简单的集成,而是历时六个月不断打磨的工具、规则和提示词组合。他坦言这套系统源自 OpenCloud/Cloud Channel(现更名为 Hermes 代理)的持续迭代。

这也正是本教程最诚实的地方:安装只需对 Claude Code 说三句话就能完成,但把 AI 员工真正做到"能干活",需要大量优化、反复实践和试错积累。

作者提到的"每日自我改进机制"在 AI 代理领域对应一个称为 反思循环(Reflection Loop) 的设计模式:让智能体在任务结束后以"元认知"模式回顾自身行为,识别失败或低效之处,并以此更新自己的指令或规则文件。这与人类员工写工作复盘的逻辑相同,但关键挑战在于——AI 自我评估的质量高度依赖提示词设计,如果评估标准模糊,反思结果可能流于表面甚至强化错误行为。真正有效的反思循环通常需要结合可量化的输出指标(如回复率、转化率)作为锚点,而不仅仅是让模型主观判断"哪里可以做得更好"。这也解释了为何作者强调六个月的打磨:规则和技能文件的价值,恰恰在于这些从真实失败案例中提炼出的边缘情况处理逻辑。

分享:

相关推荐