지식 기반 섹션 ▾
내비게이션
▸ 여기서 시작하세요 역할별카테고리
- Cursor + Gonka AI — 코딩을 위한 저렴한 LLM
- Claude Code + Gonka AI — 터미널을 위한 LLM
- OpenClaw + Gonka AI — 저렴한 AI 에이전트
- OpenCode: 터미널에서 나만의 모델 사용
- Continue.dev + Gonka AI — VS Code/JetBrains를 위한 AI
- Cline + Gonka AI — VS Code의 AI 에이전트
- Aider + Gonka AI — AI 페어 프로그래밍
- LangChain + Gonka AI — 저렴한 AI 애플리케이션
- n8n + Gonka AI — 저렴한 AI로 자동화
- Open WebUI + Gonka AI — 나만의 ChatGPT
- LibreChat + Gonka AI — 오픈소스 ChatGPT
- Gonka 네트워크의 Hermes Agent + DeepSeek — 초저비용 자율 에이전트
- Kilo Code + Gonka AI — VS Code용 AI 에이전트
- Roo Code + Gonka AI — VS Code용 자율 AI 에이전트
- LlamaIndex + Gonka AI — 저렴한 RAG 애플리케이션
- PydanticAI + Gonka — 저렴한 유형화된 AI 에이전트
- Vercel AI SDK + Gonka AI — 저렴한 TypeScript AI 애플리케이션
- TanStack AI + Gonka — 저렴한 TypeScript AI 애플리케이션
- API 빠른 시작 — curl, Python, TypeScript
- JoinGonka Gateway — 전체 개요
- 관리 키 — Gonka 위의 SaaS
- 가장 저렴한 AI API: 2026년 제공업체 비교
- Cursor Pro 쿼리 제한 종료 — 분석 및 저렴한 대안
- 더 저렴한 Claude Code — 청구액 분석 및 전환
- Cline의 엄청난 비용 — 에이전트가 예산을 소모하는 이유
- OpenClaw 비용 부담 — 에이전트가 토큰을 소모하는 이유와 절약 전략
- OpenRouter: 저렴한 대안 — JoinGonka Gateway와 비교
- 2026년 최고의 코딩용 AI 모델: 비교 및 가격
- GitHub Copilot의 저렴한 무제한 대체 서비스
- 크레딧과 제한 없는 저렴한 Windsurf 대안
- 2026년 AI 에이전트를 위한 가장 저렴한 API
- ZCode: GLM Coding Plan 대신 사용하는 저렴한 GLM 추론
- JetBrains IDE + JoinGonka Gateway — 크레딧 대신 자체 endpoint 사용
- GitHub Copilot BYOK — 할당량 대신 자체 모델 사용
- Zed + JoinGonka Gateway — 에디터 내 저렴한 추론
- Pi + JoinGonka Gateway — 저렴한 인퍼런스를 활용한 터미널 에이전트
- Codex CLI: 구독 대신 자체 키 사용
도구
Gonka 네트워크의 Hermes Agent + DeepSeek — 초저비용 자율 에이전트
Hermes Agent는 Nous Research가 개발한 오픈 소스 자기 학습 AI 에이전트(MIT 라이선스)입니다. 단순한 채팅이 아니라 메모리, 스킬, 작업 스케줄러, 그리고 Telegram, Discord, Slack, WhatsApp 게이트웨이를 갖춘 완벽한 터미널 CLI입니다. 에이전트는 경험을 통해 스킬을 구축하고, 과거 대화를 검색하며, 세션 간 사용자 모델을 형성합니다. 5달러짜리 VPS에서도, GPU 클러스터에서도 작동합니다.
Hermes의 문제는 다른 에이전트 도구와 마찬가지로 토큰 소비량입니다. 에이전트가 파일을 읽고, tool-calling 루프를 실행하며, 컨텍스트를 압축하고, 메모리를 관리하기 때문에 활발히 작업하면 수천만 토큰이 쉽게 소모됩니다. Anthropic이나 OpenAI 모델(1M 토큰당 3~15달러)에서는 자율 작업에 하루에 수십~수백 달러가 지출됩니다.
Hermes는 기본적으로 Nous Portal, OpenRouter, OpenAI, Anthropic 또는 귀하의 자체 엔드포인트 등 모든 프로바이더를 지원합니다. 이것이 바로 JoinGonka Gateway로 가는 진입점입니다. 당사의 OpenAI 호환 게이트웨이는 1M 토큰당 $0.0069라는 수백~수천 배 저렴한 가격으로 Gonka 분산 네트워크의 인퍼런스를 제공합니다. 이를 통해 Hermes는 단순한 고가 데모를 넘어 진정한 일상적 도구가 됩니다.
단계 1: Hermes 설치 및 키 얻기
Hermes 설치 (Linux, macOS, WSL2). 공식 인스톨러가 자동으로 Python, Node.js, ripgrep 및 ffmpeg을 가져옵니다:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)설치 후 셸을 재시작하고 실행 여부를 확인하세요:
source ~/.bashrc # 또는 ~/.zshrc
hermes # 대화형 CLIJoinGonka API-key: 아직 계정이 없다면 gate.joingonka.ai/register에서 가입하고 이메일 주소를 인증하세요. 계정에 3M 무료 토큰이 적립됩니다. 그런 다음 Dashboard에서 jg- 접두사가 포함된 키를 생성하세요. 하나의 키와 하나의 잔액으로 모든 모델을 즉시 사용할 수 있습니다.
단계 2: Gonka를 사용자 지정 공급업체로 연결
Hermes는 OpenAI 호환 endpoint라면 무엇이든 작동합니다. 서버가 /v1/chat/completions에 응답하면 Hermes를 연결할 수 있습니다. JoinGonka Gateway도 동일합니다. 설정 방법은 세 가지가 있습니다.
방법 1: 공식 설치 프로그램(권장, 한 번의 명령). Hermes 구성에 공급자를 작성하고, 기본 모델로 DeepSeek V4 Flash를 설정하며, 라이브 요청을 통해 게이트가 키와 모델을 허용하는지 확인합니다:
npx @joingonka/setup --tool hermes방법 2: 설정 마법사. 터미널에서 활성 세션 외부에서 실행하십시오:
hermes model공급자 목록에서 「Custom endpoint (self-hosted / VLLM / etc.)」를 선택하고 세 가지 값을 입력합니다:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-your-key - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
방법 3: 구성 파일 편집. Hermes 설정은 ~/.hermes/config.yaml에 저장되며 이것이 유일한 진실의 원천입니다. 다음 섹션을 추가하십시오:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-your-key⚠️ 키는 model.api_key에만 기록하십시오. Hermes 문서에서는 ~/.hermes/.env의 OPENAI_API_KEY를 허용하지만 커스텀 endpoint에서는 작동하지 않습니다. Hermes는 model.api_key에서만 키를 읽으며 .env에 키가 있으면 게이트가 401 Invalid API key를 반환합니다. Hermes v0.20.4에서 확인되었습니다.
확인: hermes를 실행하고 "hello world 함수가 있는 hello.py 파일을 만들어줘"라고 입력하십시오. 에이전트가 파일을 생성하고 결과를 보여야 합니다. 현재 구성 상태는 hermes config show | grep '^model\.' 및 hermes status를 통해 확인할 수 있습니다.
실시간 전환: 세션 내에서 /model custom:deepseek-ai/DeepSeek-V4-Flash-0731 명령어를 사용하십시오. 이름 없이 /model custom을 실행하면 endpoint에 모델이 하나만 있을 경우 자동으로 가져옵니다.
자율 세션 비용 비교
Hermes는 메모리와 기술을 가진 에이전트 도구입니다. 단답형 응답을 넘어 파일 읽기, 코드 작성, 명령 실행, 컨텍스트 압축, 스케줄러를 통한 장기 백그라운드 작업 수행이 가능합니다. 모든 액션은 API 호출이며, 하루 종일 자율적으로 작동하면 수천만 토큰이 소모될 수 있습니다. 일반적인 세션의 비용을 비교해 보겠습니다:
| 작업 | 토큰 | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| 도구 호출 포함 단발 작업 | ~5M | $15 — $75 | $0.048 |
| 백그라운드 에이전트 (몇 시간) | ~20M | $60 — $300 | $0.19 |
| 자율적 기능 개발 | ~50M | $150 — $750 | $0.48 |
| 게이트웨이 경유 1일 가동 (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
JoinGonka Gateway를 사용하면 야간 보고서, 주간 감사, cron 스케줄러를 통한 백그라운드 작업 등 Hermes를 24시간 내내 가동해도 비용 걱정이 없습니다. Anthropic 가격 정책으로는 매번 직접 계산해야 했을 것입니다. 등록 시 제공되는 초기 잔액으로 실제 작업을 에이전트에 맡겨보고, 첫 충전 전에 자신의 소비량을 직접 확인할 수 있습니다.
모델 선택 및 툴 콜링
Gateway를 통해 Gonka의 3가지 모델을 바로 사용할 수 있습니다. 이 모델들은 모두 네이티브 tool calling (OpenAI function calling)을 지원하므로, 텍스트 응답을 파싱할 필요 없이 Hermes의 기술과 도구가 안정적으로 작동합니다:
| Model name (config용) | 컨텍스트 | 최대 응답 | 추천 상황 |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Hermes 기본값: 네트워크상에서 가장 긴 컨텍스트와 4배 높은 응답 제한을 제공하여 긴 tool-calling 체인과 대용량 파일을 한 번에 처리 가능 |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | 짧은 작업과 빠른 수정에 적합한 범용 모델 |
zai-org/GLM-5.3-Flash | 390K | 8192 | 가장 긴 컨텍스트를 가진 추론 모델: 답변 전 논리적 사고를 수행하므로 복잡한 로직에 적합함. 응답의 일부가 사고에 사용되므로 응답 제한을 너무 낮추지 마세요 |
Hermes 토큰 제한 관련. config.yaml의 context_length 필드는 전체 컨텍스트 윈도우(입력+출력)이며, max_tokens는 응답 길이에 대한 제한입니다. 가급적 둘 다 지정하지 않는 것이 좋습니다. Hermes가 프로바이더를 통해 올바른 값을 자동으로 결정합니다. max_tokens를 수동으로 설정할 경우 모델 제한 이내로 유지하세요. Gateway를 통해 DeepSeek V4 Flash는 32768, MiniMax M2.7 및 GLM-5.3 Flash는 8192입니다. 모델은 hermes model 명령어나 세션 내 /model을 통해 언제든지 변경 가능합니다.
지식 베이스의 유사 터미널 도구: Claude Code, Cline.