知识库章节 ▾
导航
▸ 从这里开始 按角色类别
- Cursor + Gonka AI — 便宜的 LLM 用于编码
- Claude Code + Gonka AI — 终端的 LLM
- OpenClaw + Gonka AI — 可负担的 AI 代理
- OpenCode:在终端中使用自己的模型
- Continue.dev + Gonka AI — 适用于 VS Code/JetBrains 的 AI
- Cline + Gonka AI — VS Code 中的 AI 代理
- Aider + Gonka AI — 与 AI 结对编程
- LangChain + Gonka AI — 便宜的 AI 应用程序
- n8n + Gonka AI — 通过便宜的 AI 实现自动化
- Open WebUI + Gonka AI — 您的 ChatGPT
- LibreChat + Gonka AI — 开源 ChatGPT
- Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体
- Kilo Code + Gonka AI — VS Code 中的 AI 代理
- Roo Code + Gonka AI — VS Code 中的自主 AI 代理
- LlamaIndex + Gonka AI — 低成本的 RAG 应用程序
- PydanticAI + Gonka — 低成本的类型化 AI 代理
- Vercel AI SDK + Gonka AI — 低成本的 TypeScript AI 应用程序
- TanStack AI + Gonka — 低成本的 TypeScript AI 应用程序
- API 快速入门 — curl, Python, TypeScript
- JoinGonka Gateway - 全面概述
- 管理密钥 — Gonka 上的 SaaS
- 最便宜的AI API:2026年提供商对比
- Cursor Pro 请求限制已用尽 — 解析与廉价替代方案
- Claude Code 更便宜 — 账单解析与切换
- Cline 正在烧钱 — 为什么代理花费如此之多
- OpenClaw 成本高昂 —— 为什么 Agent 会疯狂消耗 Token 以及如何节省
- OpenRouter:廉价替代方案 — 与 JoinGonka Gateway 的对比
- 2026 年最佳编码 AI 模型:对比与定价
- GitHub Copilot 无限制低成本替代方案
- 无积分、无限制的廉价 Windsurf 替代方案
- 2026 年最便宜的 AI 代理 API
- ZCode:使用低成本 GLM 推理替代 GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — 使用自己的 endpoint 替代点数消耗
- GitHub Copilot BYOK — 使用自己的模型替代配额限制
- Zed + JoinGonka Gateway — 编辑器中的低成本推理
- Pi + JoinGonka Gateway — 基于低成本推理的终端代理
- Codex CLI:使用自己的密钥代替订阅
工具
Hermes Agent + DeepSeek 在 Gonka 网络 — 极低成本的自主智能体
Hermes Agent 是来自 Nous Research (MIT 许可) 的开源自学习 AI 代理。它不仅仅是一个聊天工具:它是一个功能齐全的终端 CLI,具备记忆、技能 (skills)、任务调度器,以及接入 Telegram、Discord、Slack 和 WhatsApp 的网关。该代理能从经验中创建技能,搜索过去的对话,并在会话之间建立用户模型。它可以在从 5 美元的 VPS 到 GPU 集群的任何设备上运行。
Hermes 的问题与任何代理工具一样:token 消耗。代理会读取文件、运行 tool-calling 循环、压缩上下文、维护记忆 — 在高强度工作下很容易消耗数千万 token。按照 Anthropic 或 OpenAI 的模型价格(每 1M token 3—15 美元),这每天会变成几十到几百美元的自主运行成本。
Hermes 默认支持任何提供商:Nous Portal、OpenRouter、OpenAI、Anthropic — 或你自己的 endpoint。这是进入 JoinGonka Gateway 的入口点:我们的 OpenAI 兼容网关通过 去中心化的 Gonka 网络 提供推理,价格低至 $0.0069/1M token — 比常规成本便宜数百甚至数千倍。Hermes 从而成为了真正的日常工具,而不再是一个昂贵的演示产品。
步骤 1:安装 Hermes 并获取密钥
安装 Hermes (Linux, macOS, WSL2)。官方安装程序将自动拉取 Python、Node.js、ripgrep 和 ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)安装完成后,重启您的 shell 并检查运行情况:
source ~/.bashrc # 或 ~/.zshrc
hermes # 交互式 CLIJoinGonka API-key:如果您还没有,请在 gate.joingonka.ai/register 注册,验证您的邮箱地址 — 您的账户将获得 3M 免费代币 — 并在仪表板中创建一个带有 jg- 前缀的密钥。一个密钥和一个余额可立即用于所有模型。
步骤 2:将 Gonka 连接为自定义提供商
Hermes 可以与任何兼容 OpenAI 的 endpoint 一起使用:如果服务器响应 /v1/chat/completions,就可以指向 Hermes。JoinGonka Gateway 正是如此。有三种配置方法。
方法 1:我们的安装程序 (单命令,推荐)。它会将提供程序添加到你的 Hermes 配置中,将 DeepSeek V4 Flash 设置为默认模型,并通过实时请求验证网关是否接受该密钥和模型:
npx @joingonka/setup --tool hermes方法 2:设置向导。在终端中(在活动会话之外)运行:
hermes model在提供程序列表中,选择 «Custom endpoint (self-hosted / VLLM / etc.)» 并输入三个值:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-你的密钥 - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
方法 3:手动编辑配置。Hermes 将模型设置存储在 ~/.hermes/config.yaml 中 — 这是唯一的真理来源。添加以下部分:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-你的密钥⚠️ 密钥放置 — 仅限 model.api_key。 Hermes 文档允许在 ~/.hermes/.env 中使用 OPENAI_API_KEY,但这对于自定义 endpoint 不起作用:Hermes 仅从 model.api_key 读取密钥。如果使用 .env 中的密钥,网关将返回 401 Invalid API key。已在 Hermes v0.20.4 上验证。
验证:运行 hermes 并输入“创建一个带有 hello world 函数的 hello.py 文件”。Agent 应该创建该文件并显示结果。可以通过 hermes config show | grep '^model\.' 和 hermes status 查看当前配置状态。
即时切换:在会话内部,使用命令 /model custom:deepseek-ai/DeepSeek-V4-Flash-0731。而 /model custom (不加名称) 会在 endpoint 仅有一个模型时自动获取。
自主会话成本比较
Hermes 是一款具备记忆和技能的智能体工具。它不仅是简单的一问一答:它能读取文件、编写代码、运行命令、压缩上下文,并通过调度程序执行长时间的后台任务。每个动作都是一个 API 调用,一天的自主工作可能会积累数千万个 token。让我们比较一下典型会话的成本:
| 任务 | Token 数 | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| 带工具调用的单次任务 | ~5M | $15 — $75 | $0.048 |
| 后台智能体(数小时) | ~20M | $60 — $300 | $0.19 |
| 自主功能开发 | ~50M | $150 — $750 | $0.48 |
| 通过网关全天运行(Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
通过 JoinGonka Gateway,Hermes 可以保持 24/7 运行:夜间报告、每周审计、通过 cron 调度程序执行的后台任务——无需担心费用。按 Anthropic 的价格,每次运行都需要手动计算。注册时的初始余额足以让你在实际任务中测试智能体,并在首次充值前查看自己的消耗情况。
模型选择和工具调用
通过 Gateway,用户可立即使用三款 Gonka 模型 —— 它们全部支持原生 tool calling (OpenAI function calling),因此 Hermes 的技能和工具运行稳定,无需解析文本回复:
| Model name (用于 config) | 上下文 | 最大回复 | 选择建议 |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Hermes 默认模型:拥有网络中最长的上下文之一以及四倍的回复上限 —— 代理可在单轮对话中处理长 tool-calling 链和大型文件 |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | 适用于短任务和快速修改的均衡通用型模型 |
zai-org/GLM-5.3-Flash | 390K | 8192 | 拥有网络中最长上下文的推理模型:回复前会先思考 —— 适合处理复杂逻辑;部分回复会用于推理,因此请勿调低回复限制 |
关于 Hermes 的 token 限制。 在 config.yaml 中,context_length 字段是完整上下文窗口(输入+输出),而 max_tokens 仅作为回复长度上限。最好两者都不设置:Hermes 会自动从提供商处确定正确的值。如果手动设置 max_tokens,请将其保持在模型范围内:通过 Gateway,DeepSeek V4 Flash 为 32768,MiniMax M2.7 和 GLM-5.3 Flash 为 8192。您可以随时使用 hermes model 命令或在会话中通过 /model 更换模型。
我们知识库中类似的终端工具:Claude Code, Cline。