Bagian Basis Pengetahuan ▾
Navigasi
▸ Mulai di sini Berdasarkan peranKategori
- Cursor + Gonka AI — LLM Murah untuk Coding
- Claude Code + Gonka AI — LLM untuk Terminal
- OpenClaw + Gonka AI — Agen AI Terjangkau
- OpenCode + Gonka AI — AI Gratis untuk Kode
- Continue.dev + Gonka AI — AI untuk VS Code/JetBrains
- Cline + Gonka AI — Agen AI di VS Code
- Aider + Gonka AI — Pemrograman Berpasangan dengan AI
- LangChain + Gonka AI — Aplikasi AI dengan Biaya Rendah
- n8n + Gonka AI — Otomatisasi dengan AI Murah
- Open WebUI + Gonka AI — ChatGPT Anda Sendiri
- LibreChat + Gonka AI — ChatGPT open-source
- Agen Hermes + Gonka AI — agen otonom dengan biaya sangat rendah
- Kilo Code + Gonka AI — Agen AI di VS Code
- Roo Code + Gonka AI — Agen AI otonom di VS Code
- LlamaIndex + Gonka AI — Aplikasi RAG dengan biaya rendah
- PydanticAI + Gonka — Agen AI berjenis dengan biaya rendah
- Vercel AI SDK + Gonka AI — Aplikasi AI di TypeScript dengan biaya rendah
- TanStack AI + Gonka — Aplikasi AI di TypeScript dengan biaya rendah
- API Mulai Cepat — curl, Python, TypeScript
- JoinGonka Gateway — ulasan lengkap
- Management Keys — SaaS di Gonka
- API AI Termurah: Perbandingan Penyedia 2026
- Limit permintaan Cursor Pro habis — analisis dan alternatif murah
- Claude Code lebih murah — analisis tagihan dan cara pindah
- Cline menguras uang — mengapa agen ini menghabiskan banyak biaya
- OpenClaw berbiaya mahal — mengapa agen menghabiskan token dan cara berhemat
- OpenRouter: alternatif murah — perbandingan dengan JoinGonka Gateway
- Model AI coding terbaik 2026: perbandingan dan harga
- Alternatif murah GitHub Copilot tanpa batas
- Alternatif Windsurf Murah tanpa kredit dan batasan
- API termurah untuk AI agent di tahun 2026
- ZCode: inferensi GLM murah sebagai pengganti GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint sendiri alih-alih kredit
- GitHub Copilot BYOK — model Anda sendiri alih-alih kuota
- Zed + JoinGonka Gateway — inferensi murah di editor
- Pi + JoinGonka Gateway — agen terminal dengan inferensi murah
Tools
ZCode: inferensi GLM murah sebagai pengganti GLM Coding Plan
Pada Juni 2026, Z.ai merilis ZCode 3.0 — lingkungan pengembangan agen desktop, yang oleh perusahaan disebut sebagai «Official Harness for GLM-5.2». Produk ini dengan cepat menarik perhatian: memiliki inti agen sendiri, tugas otonom melalui /goal, mode multi-agent, dan kontrol sesi jarak jauh langsung dari Telegram. Namun seiring dengan banyaknya ulasan, muncul pula gelombang pertanyaan dari pelanggan awal GLM Coding Plan: kuota dihitung sebagai «prompt» dalam jendela lima jam, pada jam sibuk penggunaan dikalikan tiga, pada paket tingkat rendah hanya ada satu kueri paralel, dan di Hacker News orang-orang mengeluh tentang pemblokiran mendadak setelah satu hari kerja yang intens.
Kabar baiknya: ZCode secara resmi mendukung custom provider — Anda dapat menghubungkannya ke API apa pun yang kompatibel dengan OpenAI atau Anthropic dan membayar berdasarkan token aktual, bukan berdasarkan kuota langganan. Dalam panduan ini, kita akan membahas apa itu ZCode dan bagaimana cara kerja GLM Coding Plan, lalu kita akan mengatur ZCode langkah demi langkah ke JoinGonka Gateway — gateway jaringan terdesentralisasi Gonka, yang daftarnya sudah menyertakan GLM-5.2. Hasilnya: alat yang sama, model open-weight yang sama, tetapi ekonominya berdasarkan token dan ratusan kali lebih murah daripada API terpusat.
Apa itu ZCode: lingkungan pengembangan agen dari Z.ai
ZCode bukanlah «editor dengan sidebar chat», melainkan ADE: Anda mendeskripsikan tujuan, agen membuat rencana, mengedit file, menjalankan pemeriksaan, dan melakukan iterasi hingga hasil tercapai. Berfungsi sebagai aplikasi desktop di macOS dan Windows (build untuk Linux — dalam status beta).
Kemampuan utama versi 3.0:
- ZCode Agent — inti agen milik sendiri dengan integrasi mendalam GLM-5.2; selain itu, Anda dapat menghubungkan agen pihak ketiga (Claude Code, Codex, Gemini CLI, dan lainnya);
- Mode Goal (
/goal) — tugas otonom yang panjang: rencana → eksekusi → verifikasi langkah demi langkah; - Multi-agent — pengerjaan proyek secara paralel oleh beberapa agen;
- Kontrol jarak jauh — menjalankan dan mengontrol sesi dari Telegram, WeChat, dan Feishu: agen bekerja di mesin Anda, dan Anda menjawab pertanyaan dari ponsel.
Klien itu sendiri gratis, Z.ai memberikan kuota token GLM-5.2 harian kepada pengguna baru untuk perkenalan. Selanjutnya — bisa berlangganan GLM Coding Plan atau menggunakan kunci API Anda sendiri. Dan di sinilah kita perlu memahami detailnya, karena mekanisme langganan adalah bagian produk yang paling banyak dibicarakan.
GLM Coding Plan: harga, batasan, dan kuota
GLM Coding Plan adalah langganan Z.ai yang memberikan akses ke model GLM di ZCode dan dua puluh alat pihak ketiga lainnya. Pada saat publikasi (Juli 2026), struktur dasarnya terlihat seperti ini — namun harga dan promosi dapat berubah, periksa halaman langsung z.ai/subscribe:
| Paket | Harga, $/bulan | Kuota | Kueri paralel |
|---|---|---|---|
| Lite | $18 (promosi — mulai dari ~$12.6) | «Prompt» dalam jendela 5 jam + batas mingguan | 1 |
| Pro | $72 | ×4 dari Lite | 1 |
| Max | $160 | ×16 dari Lite | hingga 30 |
Keluhan pelanggan (di thread Hacker News dan GitHub):
- Multiplier jam sibuk. Pada jam sibuk (14:00—18:00 UTC+8 — petang di Asia, pagi-siang di Eropa) setiap kueri mengurangi kuota dengan koefisien ×3, di luar jam sibuk — ×2. Anda harus merencanakan penggunaan berdasarkan zona waktu Beijing.
- Kuota berdasarkan «prompt», bukan token. Berapa banyak token yang tersisa — tidak transparan; di dalam thread terdapat cerita seperti «saya menghabiskan ~17M token di GLM — dan diblokir selama empat hari».
- Satu kueri paralel pada paket Lite dan Pro. Untuk lingkungan agen, ini terasa: mode multi-agent ZCode sendiri dan agen tambahan paralel apa pun akan masuk ke dalam antrean.
- GLM-5.2 mengonsumsi kuota lebih cepat daripada model yang lebih kecil — model unggulan menghabiskan batas dengan multipliernya sendiri.
Kesimpulannya sederhana: untuk pengembangan solo yang tenang, langganan ini bekerja dengan jujur. Namun, semakin «agentik» mode Anda — tugas paralel, sesi otonom yang panjang, proses malam hari — semakin sering model kuota berubah menjadi lotere. Alternatifnya adalah membayar untuk token aktual: tanpa jendela, multiplier, dan antrean — berapa banyak yang dihabiskan agen, itulah yang dipotong. Inilah model yang diberikan oleh mekanisme custom provider yang terintegrasi di ZCode, dan pengaturannya hanya memakan waktu lima menit.
BYOK di ZCode: kunci API Anda sendiri dan custom provider
ZCode secara resmi mendukung BYOK: dokumentasi secara eksplisit mengizinkan penambahan "layanan apa pun yang kompatibel dengan protokol OpenAI atau Anthropic" — API publik, saluran perusahaan, bahkan instalasi self-hosted. Dikonfigurasi dengan tiga cara:
- tombol Connect di layar sambutan → "Set Your API Key";
- Manage Models di pemilih model;
- ikon gerigi → Settings → Model Settings → Add Provider.
Penyedia diatur dengan OpenAI Base URL dan/atau Anthropic Base URL ditambah API Key — daftar model yang tersedia akan ditarik oleh ZCode secara otomatis.
Tiga kesalahan yang paling sering terjadi:
- Endpoint Z.ai berbeda. Coding Plan hanya bekerja melalui coding-endpoint
https://api.z.ai/api/coding/paas/v4;/api/paas/v4umum dengan kunci langganan akan mengembalikan error — penyebab klasik "saya mendapatkan 401/429 padahal paket sudah dibayar". - "Bekerja di Claude Code ≠ bekerja di ZCode". Variabel lingkungan seperti
ANTHROPIC_BASE_URL, yang digunakan untuk mengonfigurasi Claude Code, tidak dibaca oleh ZCode: ia memiliki penyimpanan pengaturannya sendiri untuk penyedia. Konfigurasikan melalui Settings. - "Model terlihat di pemilih ≠ kunci punya kuota". Daftar model ditarik dari API penyedia, tetapi ketersediaannya bergantung pada saldo dan batas kunci spesifik.
Selanjutnya — praktik: hubungkan gateway JoinGonka ke ZCode dan dapatkan stack GLM dengan token.
Pengaturan JoinGonka Gateway di ZCode: GLM dengan token
JoinGonka Gateway — gerbang menuju jaringan terdesentralisasi Gonka dengan dua protokol natif: /v1/chat/completions yang kompatibel dengan OpenAI dan /v1/messages Anthropic. Ekonomi sistem pay-per-token: tidak ada window 5 jam, tidak ada multiplier puncak ×3, dan tidak ada batasan jumlah permintaan paralel; penggunaan terlihat di dashboard secara real-time, gateway tidak menyimpan isi prompt.
Langkah demi langkah (antarmuka Custom Provider saat ini):
| Langkah | Tindakan |
|---|---|
| 1. Kunci | Daftarkan akun — gate.joingonka.ai/register (akun baru mendapatkan 10M token gratis), buat API-key di bagian Keys. Detail lebih lanjut — di API Quick Start. |
| 2. Provider | ZCode → Settings → Model Settings → Add Provider. Name: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | kunci Anda berformat jg-… |
| 5. API format | Chat completions (/chat/completions) |
| 6. Model | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000. Demikian pula untuk menambahkan moonshotai/Kimi-K2.6 dan MiniMaxAI/MiniMax-M2.7; daftar saat ini — GET /v1/models. |
Pada ZCode versi lama, terdapat dua kolom terpisah: OpenAI Base URL (https://gate.joingonka.ai/v1) dan Anthropic Base URL (https://gate.joingonka.ai — path akan ditambahkan oleh klien secara otomatis).
Verifikasi: pilih model yang telah dibuat dan berikan pertanyaan apa pun kepada agen. Jika jawaban muncul — semuanya berfungsi; jika error 401 — periksa kuncinya, 402 — saldo akun. Jika pada DeepSeek V4 Flash muncul pesan «Model request failed» saat Thought Level Max — ubah Thought Level ke High lalu ulangi permintaan.
Petunjuk. Perintah npx @joingonka/setup --tool zcode akan mencetak nilai siap pakai untuk kolom di bawah (base URL, kunci, id model dengan limit terkini) dan melakukan pengecekan langsung apakah gateway menerimanya. ZCode sendiri hanya dapat diatur melalui UI — tidak ada file yang bisa diedit dengan aman, jadi nilai harus dimasukkan secara manual.
Perbandingan harga: Coding Plan, Z.ai API, OpenRouter dan Gonka
Berapa biaya inferensi GLM pada saluran yang berbeda (harga per 1M token; harga kompetitor ditetapkan pada Juli 2026, harga JoinGonka diambil secara langsung ke halaman dari gateway API):
| Saluran | Input, $/1M | Output, $/1M | Model Pembayaran |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (input di-cache — $0.26) | $4.40 | per token |
| GLM Coding Plan | $18—160/bulan | langganan: kuota per "prompt", pengganda ×3 saat puncak, batas paralel | |
| OpenRouter (z-ai/glm-5.2) | $0.93 | $3.00 | per token; tidak ada opsi gratis untuk GLM-5.2 |
| JoinGonka Gateway | $0.0032 | $0.0097 | per token, jaringan Gonka |
Perbedaan dua hingga tiga orde besaran atau tiga tingkat bukan sekadar pembulatan pemasaran, melainkan ekonomi yang berbeda: komputasi dilakukan oleh peserta jaringan terdesentralisasi yang memperoleh penghasilan dari pekerjaan itu sendiri, bukan dari margin pusat data. Penjelasan rinci tentang cara kerjanya dan batas penerapannya ada dalam artikel tentang AI API termurah.
Pernyataan jujur tentang GLM-5.2: jaringan akan menetapkan harga model yang tepat pada saat aktivasi (tabel di atas menunjukkan harga langsung saat ini dari model jaringan). Angka-angka di halaman ini diperbarui secara otomatis, tidak perlu menghitung ulang secara manual.
GLM-5.2 di jaringan Gonka: status dan pertanyaan umum
Model zai-org/GLM-5.2-FP8 telah ditambahkan ke registri on-chain jaringan Gonka: konfigurasinya mengatur jendela konteks hingga 400K token, dan model itu sendiri termasuk dalam kategori berat (satu replika memerlukan lebih dari satu terabyte VRAM). Sekarang sedang dalam tahap peluncuran: node jaringan sedang memanaskan bobotnya. Segera setelah pemeriksaan menjadi hijau, model akan otomatis muncul di daftar model gateway — base URL dan kunci tidak berubah, di ZCode Anda hanya perlu memilihnya di pemilih.
Mengenai modelnya sendiri: bobot terbuka di bawah lisensi MIT, arsitektur MoE dengan ~750B parameter (sekitar 40B aktif per token), jendela asli hingga 1M token. Menurut data Z.ai, pada SWE-bench Pro model ini menunjukkan skor 62.1 — lebih tinggi dari GPT-5.5, dan pada FrontierSWE tertinggal sekitar satu persen dari Claude Opus 4.8. Untuk model open-weight, ini adalah baris pertama dalam coding.
Pertanyaan yang sering diajukan:
- Mengapa setelah mengaktifkan model baru sering terjadi error 429? — Ini adalah fase peluncuran: sebagian node masih memuat bobot. Ulangi permintaan dalam beberapa detik — load balancer akan menemukan node yang aktif.
- Apa yang tersedia hari ini? — Kimi K2.6, MiniMax M2.7, dan DeepSeek V4 Flash: ketiganya berfungsi di ZCode melalui penyedia kustom yang sama, konfigurasi dari panduan ini sepenuhnya berfungsi sekarang.
- Bagaimana dengan privasi? — Gateway tidak menyimpan konten prompt dan jawaban; dalam statistik hanya terdapat agregat penggunaan.
- Kapan Coding Plan lebih menguntungkan? — Jika Anda bekerja solo, memenuhi kuota Lite, dan tidak menjalankan agen paralel, langganan dengan biaya tetap nyaman dan dapat diprediksi. Hitung sesuai profil Anda: untuk pekerjaan agen yang aktif, pembayaran token melalui jaringan jauh lebih murah, untuk pengeditan kode ringan sesekali perbedaannya mungkin tidak terasa.
- Apakah ini cocok untuk alat lain? — Ya: endpoint yang sama berfungsi di Claude Code, Cursor, Cline, dan klien yang kompatibel dengan OpenAI/Anthropic lainnya.
Ingin tahu lebih banyak?
Jelajahi bagian lain atau mulai hasilkan GNK sekarang.
Dapatkan 10M token gratis →