知识库章节 ▾

导航

▸ 从这里开始 按角色

类别

工具 37
词汇表 12

工具

Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体

Hermes Agent 是来自 Nous Research (MIT 许可) 的开源自学习 AI 代理。它不仅仅是一个聊天工具:它是一个功能齐全的终端 CLI,具备记忆、技能 (skills)、任务调度器,以及接入 Telegram、Discord、Slack 和 WhatsApp 的网关。该代理能从经验中创建技能,搜索过去的对话,并在会话之间建立用户模型。它可以在从 5 美元的 VPS 到 GPU 集群的任何设备上运行。

Hermes 的问题与任何代理工具一样:token 消耗。代理会读取文件、运行 tool-calling 循环、压缩上下文、维护记忆 — 在高强度工作下很容易消耗数千万 token。按照 Anthropic 或 OpenAI 的模型价格(每 1M token 3—15 美元),这每天会变成几十到几百美元的自主运行成本。

Hermes 默认支持任何提供商:Nous Portal、OpenRouter、OpenAI、Anthropic — 或你自己的 endpoint。这是进入 JoinGonka Gateway 的入口点:我们的 OpenAI 兼容网关通过 去中心化的 Gonka 网络 提供推理,价格低至 $0.0069/1M token — 比常规成本便宜数百甚至数千倍。Hermes 从而成为了真正的日常工具,而不再是一个昂贵的演示产品。

步骤 1:安装 Hermes 并获取密钥

安装 Hermes (Linux, macOS, WSL2)。官方安装程序将自动拉取 Python、Node.js、ripgrep 和 ffmpeg:

# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

安装完成后,重启您的 shell 并检查运行情况:

source ~/.bashrc   # 或 ~/.zshrc
hermes             # 交互式 CLI

JoinGonka API-key:如果您还没有,请在 gate.joingonka.ai/register 注册,验证您的邮箱地址 — 您的账户将获得 3M 免费代币 — 并在仪表板中创建一个带有 jg- 前缀的密钥。一个密钥和一个余额可立即用于所有模型。

步骤 2:将 Gonka 连接为自定义提供商

Hermes 可以与任何兼容 OpenAI 的 endpoint 一起使用:如果服务器响应 /v1/chat/completions,就可以指向 Hermes。JoinGonka Gateway 正是如此。有三种配置方法。

方法 1:我们的安装程序 (单命令,推荐)。它会将提供程序添加到你的 Hermes 配置中,将 DeepSeek V4 Flash 设置为默认模型,并通过实时请求验证网关是否接受该密钥和模型:

npx @joingonka/setup --tool hermes

方法 2:设置向导。在终端中(活动会话之外)运行:

hermes model

在提供程序列表中,选择 «Custom endpoint (self-hosted / VLLM / etc.)» 并输入三个值:

  • API base URL: https://gate.joingonka.ai/v1
  • API key: jg-你的密钥
  • Model name: deepseek-ai/DeepSeek-V4-Flash-0731

方法 3:手动编辑配置。Hermes 将模型设置存储在 ~/.hermes/config.yaml 中 — 这是唯一的真理来源。添加以下部分:

# ~/.hermes/config.yaml
model:
  provider: custom
  model: deepseek-ai/DeepSeek-V4-Flash-0731
  base_url: https://gate.joingonka.ai/v1
  api_key: jg-你的密钥

⚠️ 密钥放置 — 仅限 model.api_key Hermes 文档允许在 ~/.hermes/.env 中使用 OPENAI_API_KEY,但这对于自定义 endpoint 不起作用:Hermes 仅从 model.api_key 读取密钥。如果使用 .env 中的密钥,网关将返回 401 Invalid API key。已在 Hermes v0.20.4 上验证。

验证:运行 hermes 并输入“创建一个带有 hello world 函数的 hello.py 文件”。Agent 应该创建该文件并显示结果。可以通过 hermes config show | grep '^model\.'hermes status 查看当前配置状态。

即时切换:在会话内部,使用命令 /model custom:deepseek-ai/DeepSeek-V4-Flash-0731。而 /model custom (不加名称) 会在 endpoint 仅有一个模型时自动获取。

自主会话成本比较

Hermes 是一款具备记忆和技能的智能体工具。它不仅是简单的一问一答:它能读取文件、编写代码、运行命令、压缩上下文,并通过调度程序执行长时间的后台任务。每个动作都是一个 API 调用,一天的自主工作可能会积累数千万个 token。让我们比较一下典型会话的成本:

任务Token 数Anthropic ClaudeJoinGonka Gonka
带工具调用的单次任务~5M$15 — $75$0.048
后台智能体(数小时)~20M$60 — $300$0.19
自主功能开发~50M$150 — $750$0.48
通过网关全天运行(Telegram + cron)~150M$450 — $2,250$1.44

通过 JoinGonka Gateway,Hermes 可以保持 24/7 运行:夜间报告、每周审计、通过 cron 调度程序执行的后台任务——无需担心费用。按 Anthropic 的价格,每次运行都需要手动计算。注册时的初始余额足以让你在实际任务中测试智能体,并在首次充值前查看自己的消耗情况。

模型选择和工具调用

通过 Gateway,用户可立即使用三款 Gonka 模型 —— 它们全部支持原生 tool calling (OpenAI function calling),因此 Hermes 的技能和工具运行稳定,无需解析文本回复:

Model name (用于 config)上下文最大回复选择建议
deepseek-ai/DeepSeek-V4-Flash-0731380K32768Hermes 默认模型:拥有网络中最长的上下文之一以及四倍的回复上限 —— 代理可在单轮对话中处理长 tool-calling 链和大型文件
MiniMaxAI/MiniMax-M2.7200K8192适用于短任务和快速修改的均衡通用型模型
zai-org/GLM-5.3-Flash390K8192拥有网络中最长上下文的推理模型:回复前会先思考 —— 适合处理复杂逻辑;部分回复会用于推理,因此请勿调低回复限制

关于 Hermes 的 token 限制。config.yaml 中,context_length 字段是完整上下文窗口(输入+输出),而 max_tokens 仅作为回复长度上限。最好两者都不设置:Hermes 会自动从提供商处确定正确的值。如果手动设置 max_tokens,请将其保持在模型范围内:通过 Gateway,DeepSeek V4 Flash 为 32768,MiniMax M2.7 和 GLM-5.3 Flash 为 8192。您可以随时使用 hermes model 命令或在会话中通过 /model 更换模型。

我们知识库中类似的终端工具:Claude Code, Cline

Hermes Agent + Gonka = 以极低成本运行的自主 Nous Research AI 代理。24 小时后台运行仅需 $1.44,而 Anthropic 则需 $450-2,250。设置方式 —— npx @joingonka/setup --tool hermes(或手动配置 custom 提供商并填入我们的网关 base_url),原生 tool calling,三种模型可选:380K 上下文的 DeepSeek V4 Flash、MiniMax M2.7 和 GLM-5.3 Flash。验证地址后即可获得起始余额,用于您的首个真实任务。

想了解更多?

探索其他章节或立即开始赚取 GNK。

免费获取初始余额 →