Bagian Basis Pengetahuan ▾

Navigasi

▸ Mulai di sini Berdasarkan peran

Kategori

Alat 37
Glosarium 12

Alat

Agen Hermes + DeepSeek di jaringan Gonka — agen otonom dengan harga murah

Hermes Agent adalah AI-agent swabelajar open-source dari Nous Research (lisensi MIT). Ini bukan sekadar chat: CLI terminal lengkap dengan memori, skills, penjadwal tugas, dan gateway ke Telegram, Discord, Slack, dan WhatsApp. Agen membuat skill dari pengalaman, mencari di dialog masa lalu, dan membangun model pengguna antar sesi. Dapat dijalankan di VPS seharga $5 atau di cluster GPU.

Masalah Hermes sama dengan alat agen apa pun: konsumsi token. Agen membaca file, menjalankan siklus tool-calling, memadatkan konteks, mengelola memori — dalam pekerjaan aktif, puluhan juta token mudah terpakai. Pada model Anthropic atau OpenAI ($3-15 per 1M), ini berubah menjadi puluhan dan ratusan dolar per hari kerja otonom.

Hermes secara default mendukung penyedia mana pun: Nous Portal, OpenRouter, OpenAI, Anthropic — atau endpoint Anda sendiri. Ini adalah titik masuk untuk JoinGonka Gateway: gateway kami yang kompatibel dengan OpenAI memberikan inference dari jaringan terdesentralisasi Gonka dengan harga mulai dari $0.0069 per 1M token — ratusan hingga ribuan kali lebih murah. Hermes menjadi alat sehari-hari yang sesungguhnya, bukan sekadar demonstrasi mahal.

Langkah 1: Instal Hermes dan dapatkan kunci

Instalasi Hermes (Linux, macOS, WSL2). Installer resmi akan secara otomatis menarik Python, Node.js, ripgrep, dan ffmpeg:

# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash

# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)

Setelah instalasi, restart shell Anda dan periksa apakah berjalan:

source ~/.bashrc   # atau ~/.zshrc
hermes             # CLI interaktif

API-key JoinGonka: jika Anda belum memilikinya, daftar di gate.joingonka.ai/register, verifikasi alamat email Anda — 3M token gratis akan dikreditkan ke akun Anda — dan buat kunci dengan prefiks jg- di Dashboard. Satu kunci dan satu saldo berfungsi untuk semua model secara langsung.

Langkah 2: Hubungkan Gonka sebagai penyedia kustom

Hermes bekerja dengan endpoint apa pun yang kompatibel dengan OpenAI: jika server merespons /v1/chat/completions — Hermes dapat diarahkan ke sana. Gateway JoinGonka adalah persis seperti itu. Ada tiga cara untuk mengatur.

Cara 1: installer kami (satu perintah, direkomendasikan). Akan menuliskan penyedia di konfigurasi Hermes, memasang DeepSeek V4 Flash sebagai model default, dan melakukan pengecekan langsung untuk memastikan gateway menerima kunci dan model tersebut:

npx @joingonka/setup --tool hermes

Cara 2: wizard pengaturan. Jalankan di terminal di luar sesi aktif:

hermes model

Dalam daftar penyedia, pilih «Custom endpoint (self-hosted / VLLM / etc.)» dan masukkan tiga nilai:

  • API base URL: https://gate.joingonka.ai/v1
  • API key: jg-kunci-anda
  • Model name: deepseek-ai/DeepSeek-V4-Flash-0731

Cara 3: mengubah konfigurasi. Hermes menyimpan pengaturan model di ~/.hermes/config.yaml — ini adalah satu-satunya sumber kebenaran. Tambahkan bagian berikut:

# ~/.hermes/config.yaml
model:
  provider: custom
  model: deepseek-ai/DeepSeek-V4-Flash-0731
  base_url: https://gate.joingonka.ai/v1
  api_key: jg-kunci-anda

⚠️ Kunci hanya boleh ada di model.api_key. Dokumentasi Hermes mengizinkan OPENAI_API_KEY di ~/.hermes/.env, tetapi untuk endpoint kustom ini tidak berfungsi: Hermes membaca kunci hanya dari model.api_key, dan dengan kunci di .env, gateway akan menjawab 401 Invalid API key. Telah diverifikasi pada Hermes v0.20.4.

Verifikasi: jalankan hermes dan tulis «Buat file hello.py dengan fungsi hello world». Agen harus membuat file tersebut dan menampilkan hasilnya. Status konfigurasi saat ini dapat dilihat melalui hermes config show | grep '^model\.' dan hermes status.

Beralih saat itu juga: di dalam sesi gunakan perintah /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Dan /model custom tanpa nama akan menarik model dari endpoint jika hanya ada satu model di sana.

Perbandingan biaya sesi otonom

Hermes adalah alat agen dengan memori dan keterampilan. Ia tidak menjawab dengan satu balasan: ia membaca file, menulis kode, menjalankan perintah, mengompres konteks, melakukan tugas latar belakang yang lama melalui penjadwal. Setiap tindakan adalah panggilan API, dan dalam sehari kerja otonom terkumpul puluhan juta token. Mari bandingkan biaya sesi tipikal:

TugasTokenAnthropic ClaudeJoinGonka Gonka
Tugas tunggal dengan tool-calling~5M$15 — $75$0.048
Agen latar belakang (beberapa jam)~20M$60 — $300$0.19
Pengembangan fitur otonom~50M$150 — $750$0.48
Kerja 24 jam via gateway (Telegram + cron)~150M$450 — $2,250$1.44

Dengan JoinGonka Gateway Hermes dapat tetap berjalan sepanjang waktu: laporan malam, audit mingguan, tugas latar belakang melalui penjadwal cron — tanpa melihat tagihan. Dengan harga Anthropic, setiap peluncuran seperti itu harus dihitung secara manual. Saldo awal saat pendaftaran cukup untuk menjalankan agen pada tugas nyata dan melihat pengeluaran sendiri sebelum pengisian pertama.

Pilihan model dan pemanggilan alat

Melalui Gateway, pengguna langsung mendapatkan akses ke tiga model Gonka — semuanya mendukung native tool calling (OpenAI function calling), sehingga skill dan tools Hermes bekerja dengan andal tanpa perlu melakukan parsing pada respons teks:

Nama model (untuk config)KonteksRespons MaksKapan harus memilih
deepseek-ai/DeepSeek-V4-Flash-0731380K32768Default untuk Hermes: salah satu konteks terpanjang di jaringan dan batas respons empat kali lebih besar — agen dapat menangani rangkaian tool-calling yang panjang dan file besar dalam satu langkah
MiniMaxAI/MiniMax-M2.7200K8192Model serba guna yang stabil untuk tugas pendek dan perbaikan cepat
zai-org/GLM-5.3-Flash390K8192Model reasoning dengan konteks terpanjang di jaringan: berpikir sebelum menjawab — untuk logika yang rumit; sebagian respons digunakan untuk berpikir, jadi jangan turunkan limit respons

Tentang limit token di Hermes. Pada config.yaml, field context_length adalah jendela konteks total (input + output), dan max_tokens adalah batas untuk panjang respons saja. Keduanya sebaiknya tidak diatur: Hermes akan menentukan nilai yang tepat dari provider secara otomatis. Jika Anda mengatur max_tokens secara manual, jaga agar tetap dalam batas model: melalui Gateway, batasnya adalah 32768 untuk DeepSeek V4 Flash dan 8192 untuk MiniMax M2.7 serta GLM-5.3 Flash. Anda dapat mengganti model kapan saja dengan perintah hermes model atau langsung di dalam sesi melalui /model.

Tool terminal serupa di basis pengetahuan kami: Claude Code, Cline.

Hermes Agent + Gonka = AI agent otonom Nous Research dengan biaya sangat murah. Operasi latar belakang selama sehari memakan biaya $1.44 dibandingkan $450-2.250 di Anthropic. Pengaturan — npx @joingonka/setup --tool hermes (atau provider custom dengan base_url gateway kami secara manual), native tool calling, tiga model pilihan: DeepSeek V4 Flash dengan konteks 380K, MiniMax M2.7, dan GLM-5.3 Flash. Saldo awal setelah verifikasi alamat — untuk tugas nyata pertama Anda.

Ingin tahu lebih banyak?

Jelajahi bagian lain atau mulai hasilkan GNK sekarang.

Dapatkan saldo awal gratis →