Bagian Basis Pengetahuan ▾
Navigasi
▸ Mulai di sini Berdasarkan peranKategori
- Cursor + Gonka AI — LLM Murah untuk Coding
- Claude Code + Gonka AI — LLM untuk Terminal
- OpenClaw + Gonka AI — Agen AI Terjangkau
- OpenCode: model Anda sendiri di terminal
- Continue.dev + Gonka AI — AI untuk VS Code/JetBrains
- Cline + Gonka AI — Agen AI di VS Code
- Aider + Gonka AI — Pemrograman Berpasangan dengan AI
- LangChain + Gonka AI — Aplikasi AI dengan Biaya Rendah
- n8n + Gonka AI — Otomatisasi dengan AI Murah
- Open WebUI + Gonka AI — ChatGPT Anda Sendiri
- LibreChat + Gonka AI — ChatGPT open-source
- Agen Hermes + DeepSeek di jaringan Gonka — agen otonom dengan harga murah
- Kilo Code + Gonka AI — Agen AI di VS Code
- Roo Code + Gonka AI — Agen AI otonom di VS Code
- LlamaIndex + Gonka AI — Aplikasi RAG dengan biaya rendah
- PydanticAI + Gonka — Agen AI berjenis dengan biaya rendah
- Vercel AI SDK + Gonka AI — Aplikasi AI di TypeScript dengan biaya rendah
- TanStack AI + Gonka — Aplikasi AI di TypeScript dengan biaya rendah
- API Mulai Cepat — curl, Python, TypeScript
- JoinGonka Gateway — ulasan lengkap
- Management Keys — SaaS di Gonka
- API AI Termurah: Perbandingan Penyedia 2026
- Limit permintaan Cursor Pro habis — analisis dan alternatif murah
- Claude Code lebih murah — analisis tagihan dan cara pindah
- Cline menguras uang — mengapa agen ini menghabiskan banyak biaya
- OpenClaw berbiaya mahal — mengapa agen menghabiskan token dan cara berhemat
- OpenRouter: alternatif murah — perbandingan dengan JoinGonka Gateway
- Model AI coding terbaik 2026: perbandingan dan harga
- Alternatif murah GitHub Copilot tanpa batas
- Alternatif Windsurf Murah tanpa kredit dan batasan
- API termurah untuk AI agent di tahun 2026
- ZCode: inferensi GLM murah sebagai pengganti GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint sendiri alih-alih kredit
- GitHub Copilot BYOK — model Anda sendiri alih-alih kuota
- Zed + JoinGonka Gateway — inferensi murah di editor
- Pi + JoinGonka Gateway — agen terminal dengan inferensi murah
- Codex CLI: kunci Anda sendiri alih-alih langganan
Alat
Agen Hermes + DeepSeek di jaringan Gonka — agen otonom dengan harga murah
Hermes Agent adalah AI-agent swabelajar open-source dari Nous Research (lisensi MIT). Ini bukan sekadar chat: CLI terminal lengkap dengan memori, skills, penjadwal tugas, dan gateway ke Telegram, Discord, Slack, dan WhatsApp. Agen membuat skill dari pengalaman, mencari di dialog masa lalu, dan membangun model pengguna antar sesi. Dapat dijalankan di VPS seharga $5 atau di cluster GPU.
Masalah Hermes sama dengan alat agen apa pun: konsumsi token. Agen membaca file, menjalankan siklus tool-calling, memadatkan konteks, mengelola memori — dalam pekerjaan aktif, puluhan juta token mudah terpakai. Pada model Anthropic atau OpenAI ($3-15 per 1M), ini berubah menjadi puluhan dan ratusan dolar per hari kerja otonom.
Hermes secara default mendukung penyedia mana pun: Nous Portal, OpenRouter, OpenAI, Anthropic — atau endpoint Anda sendiri. Ini adalah titik masuk untuk JoinGonka Gateway: gateway kami yang kompatibel dengan OpenAI memberikan inference dari jaringan terdesentralisasi Gonka dengan harga mulai dari $0.0069 per 1M token — ratusan hingga ribuan kali lebih murah. Hermes menjadi alat sehari-hari yang sesungguhnya, bukan sekadar demonstrasi mahal.
Langkah 1: Instal Hermes dan dapatkan kunci
Instalasi Hermes (Linux, macOS, WSL2). Installer resmi akan secara otomatis menarik Python, Node.js, ripgrep, dan ffmpeg:
# Linux / macOS / WSL2
curl -fsSL https://hermes-agent.nousresearch.com/install.sh | bash
# Windows (PowerShell)
iex (irm https://hermes-agent.nousresearch.com/install.ps1)Setelah instalasi, restart shell Anda dan periksa apakah berjalan:
source ~/.bashrc # atau ~/.zshrc
hermes # CLI interaktifAPI-key JoinGonka: jika Anda belum memilikinya, daftar di gate.joingonka.ai/register, verifikasi alamat email Anda — 3M token gratis akan dikreditkan ke akun Anda — dan buat kunci dengan prefiks jg- di Dashboard. Satu kunci dan satu saldo berfungsi untuk semua model secara langsung.
Langkah 2: Hubungkan Gonka sebagai penyedia kustom
Hermes bekerja dengan endpoint apa pun yang kompatibel dengan OpenAI: jika server merespons /v1/chat/completions — Hermes dapat diarahkan ke sana. Gateway JoinGonka adalah persis seperti itu. Ada tiga cara untuk mengatur.
Cara 1: installer kami (satu perintah, direkomendasikan). Akan menuliskan penyedia di konfigurasi Hermes, memasang DeepSeek V4 Flash sebagai model default, dan melakukan pengecekan langsung untuk memastikan gateway menerima kunci dan model tersebut:
npx @joingonka/setup --tool hermesCara 2: wizard pengaturan. Jalankan di terminal di luar sesi aktif:
hermes modelDalam daftar penyedia, pilih «Custom endpoint (self-hosted / VLLM / etc.)» dan masukkan tiga nilai:
- API base URL:
https://gate.joingonka.ai/v1 - API key:
jg-kunci-anda - Model name:
deepseek-ai/DeepSeek-V4-Flash-0731
Cara 3: mengubah konfigurasi. Hermes menyimpan pengaturan model di ~/.hermes/config.yaml — ini adalah satu-satunya sumber kebenaran. Tambahkan bagian berikut:
# ~/.hermes/config.yaml
model:
provider: custom
model: deepseek-ai/DeepSeek-V4-Flash-0731
base_url: https://gate.joingonka.ai/v1
api_key: jg-kunci-anda⚠️ Kunci hanya boleh ada di model.api_key. Dokumentasi Hermes mengizinkan OPENAI_API_KEY di ~/.hermes/.env, tetapi untuk endpoint kustom ini tidak berfungsi: Hermes membaca kunci hanya dari model.api_key, dan dengan kunci di .env, gateway akan menjawab 401 Invalid API key. Telah diverifikasi pada Hermes v0.20.4.
Verifikasi: jalankan hermes dan tulis «Buat file hello.py dengan fungsi hello world». Agen harus membuat file tersebut dan menampilkan hasilnya. Status konfigurasi saat ini dapat dilihat melalui hermes config show | grep '^model\.' dan hermes status.
Beralih saat itu juga: di dalam sesi gunakan perintah /model custom:deepseek-ai/DeepSeek-V4-Flash-0731. Dan /model custom tanpa nama akan menarik model dari endpoint jika hanya ada satu model di sana.
Perbandingan biaya sesi otonom
Hermes adalah alat agen dengan memori dan keterampilan. Ia tidak menjawab dengan satu balasan: ia membaca file, menulis kode, menjalankan perintah, mengompres konteks, melakukan tugas latar belakang yang lama melalui penjadwal. Setiap tindakan adalah panggilan API, dan dalam sehari kerja otonom terkumpul puluhan juta token. Mari bandingkan biaya sesi tipikal:
| Tugas | Token | Anthropic Claude | JoinGonka Gonka |
|---|---|---|---|
| Tugas tunggal dengan tool-calling | ~5M | $15 — $75 | $0.048 |
| Agen latar belakang (beberapa jam) | ~20M | $60 — $300 | $0.19 |
| Pengembangan fitur otonom | ~50M | $150 — $750 | $0.48 |
| Kerja 24 jam via gateway (Telegram + cron) | ~150M | $450 — $2,250 | $1.44 |
Dengan JoinGonka Gateway Hermes dapat tetap berjalan sepanjang waktu: laporan malam, audit mingguan, tugas latar belakang melalui penjadwal cron — tanpa melihat tagihan. Dengan harga Anthropic, setiap peluncuran seperti itu harus dihitung secara manual. Saldo awal saat pendaftaran cukup untuk menjalankan agen pada tugas nyata dan melihat pengeluaran sendiri sebelum pengisian pertama.
Pilihan model dan pemanggilan alat
Melalui Gateway, pengguna langsung mendapatkan akses ke tiga model Gonka — semuanya mendukung native tool calling (OpenAI function calling), sehingga skill dan tools Hermes bekerja dengan andal tanpa perlu melakukan parsing pada respons teks:
| Nama model (untuk config) | Konteks | Respons Maks | Kapan harus memilih |
|---|---|---|---|
deepseek-ai/DeepSeek-V4-Flash-0731 | 380K | 32768 | Default untuk Hermes: salah satu konteks terpanjang di jaringan dan batas respons empat kali lebih besar — agen dapat menangani rangkaian tool-calling yang panjang dan file besar dalam satu langkah |
MiniMaxAI/MiniMax-M2.7 | 200K | 8192 | Model serba guna yang stabil untuk tugas pendek dan perbaikan cepat |
zai-org/GLM-5.3-Flash | 390K | 8192 | Model reasoning dengan konteks terpanjang di jaringan: berpikir sebelum menjawab — untuk logika yang rumit; sebagian respons digunakan untuk berpikir, jadi jangan turunkan limit respons |
Tentang limit token di Hermes. Pada config.yaml, field context_length adalah jendela konteks total (input + output), dan max_tokens adalah batas untuk panjang respons saja. Keduanya sebaiknya tidak diatur: Hermes akan menentukan nilai yang tepat dari provider secara otomatis. Jika Anda mengatur max_tokens secara manual, jaga agar tetap dalam batas model: melalui Gateway, batasnya adalah 32768 untuk DeepSeek V4 Flash dan 8192 untuk MiniMax M2.7 serta GLM-5.3 Flash. Anda dapat mengganti model kapan saja dengan perintah hermes model atau langsung di dalam sesi melalui /model.
Tool terminal serupa di basis pengetahuan kami: Claude Code, Cline.
Ingin tahu lebih banyak?
Jelajahi bagian lain atau mulai hasilkan GNK sekarang.
Dapatkan saldo awal gratis →