지식 기반 섹션 ▾
내비게이션
▸ 여기서 시작하세요 역할별카테고리
- Cursor + Gonka AI — 코딩을 위한 저렴한 LLM
- Claude Code + Gonka AI — 터미널을 위한 LLM
- OpenClaw + Gonka AI — 저렴한 AI 에이전트
- OpenCode + Gonka AI — 코드를 위한 무료 AI
- Continue.dev + Gonka AI — VS Code/JetBrains를 위한 AI
- Cline + Gonka AI — VS Code의 AI 에이전트
- Aider + Gonka AI — AI 페어 프로그래밍
- LangChain + Gonka AI — 저렴한 AI 애플리케이션
- n8n + Gonka AI — 저렴한 AI로 자동화
- Open WebUI + Gonka AI — 나만의 ChatGPT
- LibreChat + Gonka AI — 오픈소스 ChatGPT
- Hermes Agent + Gonka AI — 저렴한 가격에 자율 에이전트
- Kilo Code + Gonka AI — VS Code용 AI 에이전트
- Roo Code + Gonka AI — VS Code용 자율 AI 에이전트
- LlamaIndex + Gonka AI — 저렴한 RAG 애플리케이션
- PydanticAI + Gonka — 저렴한 유형화된 AI 에이전트
- Vercel AI SDK + Gonka AI — 저렴한 TypeScript AI 애플리케이션
- TanStack AI + Gonka — 저렴한 TypeScript AI 애플리케이션
- API 빠른 시작 — curl, Python, TypeScript
- JoinGonka Gateway — 전체 개요
- 관리 키 — Gonka 위의 SaaS
- 가장 저렴한 AI API: 2026년 제공업체 비교
- Cursor Pro 쿼리 제한 종료 — 분석 및 저렴한 대안
- 더 저렴한 Claude Code — 청구액 분석 및 전환
- Cline의 엄청난 비용 — 에이전트가 예산을 소모하는 이유
- OpenClaw 비용 부담 — 에이전트가 토큰을 소모하는 이유와 절약 전략
- OpenRouter: 저렴한 대안 — JoinGonka Gateway와 비교
- 2026년 최고의 코딩용 AI 모델: 비교 및 가격
- GitHub Copilot의 저렴한 무제한 대체 서비스
- 크레딧과 제한 없는 저렴한 Windsurf 대안
- 2026년 AI 에이전트를 위한 가장 저렴한 API
- ZCode: GLM Coding Plan 대신 사용하는 저렴한 GLM 추론
도구
Hermes Agent + Gonka AI — 저렴한 가격에 자율 에이전트
Hermes Agent는 Nous Research가 만든 오픈소스 자기학습형 AI 에이전트(MIT 라이선스)입니다. 단순히 챗봇이 아닙니다. 메모리, 스킬, 작업 스케줄러를 갖추고 Telegram, Discord, Slack, WhatsApp과 연결되는 완전한 터미널 CLI입니다. 에이전트는 경험을 통해 스킬을 생성하고, 과거 대화를 검색하며 세션 간 사용자 모델을 구축합니다. $5짜리 VPS부터 GPU 클러스터까지 어디서든 실행할 수 있습니다.
Hermes의 문제는 다른 에이전트 도구와 마찬가지로 토큰 소비량입니다. 에이전트는 파일을 읽고, tool-calling 루프를 실행하며, 컨텍스트를 압축하고, 메모리를 관리하는데, 활발하게 작업하면 금방 수천만 토큰이 소모됩니다. Anthropic이나 OpenAI 모델(1M 토큰당 $3~15)을 사용하면 자율 작업만으로 하루에 수백 달러의 비용이 발생할 수 있습니다.
Hermes는 기본적으로 Nous Portal, OpenRouter, OpenAI, Anthropic 또는 나만의 커스텀 엔드포인트를 지원합니다. 이것이 JoinGonka Gateway로 들어가는 통로입니다. 당사의 OpenAI 호환 게이트웨이는 Gonka 탈중앙화 네트워크를 통해 1M 토큰당 $0.003부터 인퍼런스를 제공하여, 비용을 수백~수천 배 절감합니다. 이제 Hermes는 비싼 데모가 아닌, 진정으로 일상에서 사용하는 도구가 됩니다.
단계 1: Hermes 설치 및 키 얻기
Hermes 설치 (Linux, macOS, WSL2). 공식 설치 프로그램은 Python, Node.js, ripgrep 및 ffmpeg를 자동으로 가져옵니다:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)설치 후 셸을 다시 시작하고 실행을 확인합니다:
source ~/.bashrc # 또는 ~/.zshrc
hermes # 대화형 CLIJoinGonka API 키: 아직 계정이 없다면 gate.joingonka.ai/register에 등록하여 10M 무료 토큰을 받고 Dashboard에서 jg- 접두사가 붙은 키를 생성하세요. 동일한 키와 잔액이 모든 모델에 즉시 적용됩니다.
단계 2: Gonka를 사용자 지정 공급업체로 연결
Hermes는 모든 OpenAI 호환 endpoint와 작동합니다. 서버가 /v1/chat/completions에 응답한다면 Hermes를 연결할 수 있습니다. JoinGonka 게이트웨이가 바로 그러한 예입니다. 두 가지 설정 방법이 있습니다.
방법 1: 설정 마법사 (권장). 활성 세션 외부의 터미널에서 다음을 실행하세요:
hermes model제공자 목록에서 「Custom endpoint (self-hosted / VLLM / etc.)」를 선택하고 세 가지 값을 입력하세요:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-your-key - Model name:
MiniMaxAI/MiniMax-M2.7
방법 2: 설정 파일 수정. Hermes는 모델 설정을 ~/.hermes/config.yaml에 저장하며, 이 파일이 모든 설정의 근거가 됩니다. 아래 섹션을 추가하세요:
# ~/.hermes/config.yaml
model:
provider: custom
default: MiniMaxAI/MiniMax-M2.7
base_url: https://gate.joingonka.ai/v1
api_key: jg-your-key확인: hermes를 실행하고 “hello world 함수가 포함된 hello.py 파일을 만들어줘”라고 입력해 보세요. 에이전트가 파일을 생성하고 결과를 보여줄 것입니다. 현재 설정 상태는 hermes config show | grep '^model\.' 및 hermes status 명령어로 확인할 수 있습니다.
실시간 전환: 세션 내에서 /model custom:MiniMaxAI/MiniMax-M2.7 명령어를 사용하세요. 이름 없이 /model custom을 입력하면 해당 endpoint에 모델이 하나만 있을 경우 자동으로 불러옵니다.
자율 세션 비용 비교
Hermes는 기억력과 기술을 갖춘 에이전트 도구입니다. 단순히 대답만 하는 것이 아니라 파일을 읽고, 코드를 작성하고, 명령어를 실행하고, 컨텍스트를 압축하며 플래너를 통해 장시간 백그라운드 작업을 수행합니다. 모든 작업은 API 호출이며, 하루 동안 자율적으로 실행되면 수천만 토큰이 누적됩니다. 일반적인 세션 비용을 비교해 보겠습니다.
| 작업 | 토큰 수 | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| 툴 호출을 포함한 일회성 작업 | ~5M | $15 — $75 | $0.024 |
| 백그라운드 에이전트 (몇 시간) | ~20M | $60 — $300 | $0.096 |
| 자율적 기능 개발 | ~50M | $150 — $750 | $0.24 |
| 게이트웨이를 통한 24시간 운영 (Telegram + cron) | ~150M | $450 — $2,250 | $0.72 |
JoinGonka Gateway를 사용하면 Hermes를 24시간 내내 실행할 수 있습니다. 야간 보고서, 주간 감사, cron 스케줄러를 통한 백그라운드 작업을 비용 걱정 없이 처리할 수 있습니다. Anthropic의 가격 정책으로는 매번 수동으로 계산해야 했을 것입니다. 등록 시 제공되는 1,000만 개의 무료 토큰으로 수십 개의 완전한 세션을 실행할 수 있습니다.
모델 선택 및 툴 콜링
Gateway를 통해 사용자는 즉시 두 개의 Gonka 모델을 사용할 수 있습니다. 두 모델 모두 기본적으로 tool calling(OpenAI function calling)을 지원하므로, 텍스트 응답을 파싱할 필요 없이 Hermes의 스킬과 도구를 신뢰성 있게 활용할 수 있습니다.
| Model name (config용) | 컨텍스트 | 최대 응답 | 추천 사용 상황 |
|---|---|---|---|
moonshotai/Kimi-K2.6 | 200K | 8192 | 기본값 - 강력한 추론, 코딩 및 에이전트 시나리오 |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | 긴 컨텍스트, 긴 tool-calling 체인 |
Hermes의 토큰 제한에 관하여。 config.yaml 파일의 context_length 필드는 전체 컨텍스트 윈도우(입력 + 출력)이며, max_tokens는 응답 길이에 대한 제한입니다. 둘 다 설정하지 않는 것이 좋습니다. Hermes가 제공자로부터 정확한 값을 자동으로 결정합니다. 수동으로 max_tokens를 설정할 경우 모델의 한도 내로 유지하십시오. Gateway를 통할 경우 두 모델 모두 최대값은 8192입니다. 모델 변경은 언제든지 hermes model 명령어나 세션 내에서 /model 명령어를 통해 가능합니다.
지식 베이스 내 유사 터미널 도구: Claude Code, Cline.