Bagian Basis Pengetahuan ▾
Navigasi
▸ Mulai di sini Berdasarkan peranKategori
- Cursor + Gonka AI — LLM Murah untuk Coding
- Claude Code + Gonka AI — LLM untuk Terminal
- OpenClaw + Gonka AI — Agen AI Terjangkau
- OpenCode: model Anda sendiri di terminal
- Continue.dev + Gonka AI — AI untuk VS Code/JetBrains
- Cline + Gonka AI — Agen AI di VS Code
- Aider + Gonka AI — Pemrograman Berpasangan dengan AI
- LangChain + Gonka AI — Aplikasi AI dengan Biaya Rendah
- n8n + Gonka AI — Otomatisasi dengan AI Murah
- Open WebUI + Gonka AI — ChatGPT Anda Sendiri
- LibreChat + Gonka AI — ChatGPT open-source
- Agen Hermes + DeepSeek di jaringan Gonka — agen otonom dengan harga murah
- Kilo Code + Gonka AI — Agen AI di VS Code
- Roo Code + Gonka AI — Agen AI otonom di VS Code
- LlamaIndex + Gonka AI — Aplikasi RAG dengan biaya rendah
- PydanticAI + Gonka — Agen AI berjenis dengan biaya rendah
- Vercel AI SDK + Gonka AI — Aplikasi AI di TypeScript dengan biaya rendah
- TanStack AI + Gonka — Aplikasi AI di TypeScript dengan biaya rendah
- API Mulai Cepat — curl, Python, TypeScript
- JoinGonka Gateway — ulasan lengkap
- Management Keys — SaaS di Gonka
- API AI Termurah: Perbandingan Penyedia 2026
- Cara membeli token AI dan kunci API: 3 cara di 2026
- Limit permintaan Cursor Pro habis — analisis dan alternatif murah
- Claude Code lebih murah — analisis tagihan dan cara pindah
- Cline menguras uang — mengapa agen ini menghabiskan banyak biaya
- OpenClaw berbiaya mahal — mengapa agen menghabiskan token dan cara berhemat
- OpenRouter: alternatif murah — perbandingan dengan JoinGonka Gateway
- Model AI coding terbaik 2026: perbandingan dan harga
- Alternatif murah GitHub Copilot tanpa batas
- Alternatif Windsurf Murah tanpa kredit dan batasan
- API termurah untuk AI agent di tahun 2026
- ZCode: inferensi GLM murah sebagai pengganti GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint sendiri alih-alih kredit
- GitHub Copilot BYOK — model Anda sendiri alih-alih kuota
- Zed + JoinGonka Gateway — inferensi murah di editor
- Pi + JoinGonka Gateway — agen terminal dengan inferensi murah
- Codex CLI: kunci Anda sendiri alih-alih langganan
- DeepSeek Harness: penyedia Anda sendiri melalui JoinGonka Gateway
- MiniMax Code: agen MiniMax dengan kunci Anda sendiri via Gonka
- Warp + JoinGonka Gateway — agen terminal di endpoint Anda sendiri
- Trae + JoinGonka Gateway — model jaringan Gonka di AI-IDE
- Cherry Studio + JoinGonka Gateway — klien AI desktop
- omp (Oh My Pi) + JoinGonka Gateway: agen dengan peran model
- OpenHands + JoinGonka Gateway: agen di endpoint sendiri
- Qwen Code setelah penutupan qwen-oauth: bekerja via JoinGonka Gateway
- Goose + JoinGonka Gateway: penyedia dan kunci sendiri di keyring
- Crush + JoinGonka Gateway: agen Charm pada model jaringan Gonka
- Zoo Code + JoinGonka Gateway: migrasi dari Roo Code ke model Gonka
- Kimi Code CLI: agen Moonshot AI dengan kunci Anda melalui Gonka
- Factory Droid + JoinGonka Gateway: BYOK pada model jaringan Gonka
- MiMo Code + JoinGonka Gateway: agen Xiaomi pada model jaringan Gonka
Tools
ZCode: inferensi GLM murah sebagai pengganti GLM Coding Plan
Pada Juni 2026, Z.ai merilis ZCode 3.0 — lingkungan pengembangan agen desktop, yang oleh perusahaan disebut sebagai "Official Harness for GLM-5.2". Produk ini dengan cepat menarik perhatian: inti agen milik sendiri, tugas otonom melalui /goal, mode multi-agen, dan manajemen sesi jarak jauh langsung dari Telegram. Namun, bersamaan dengan gelombang ulasan, muncul pula gelombang pertanyaan dari pelanggan awal GLM Coding Plan: kuota dihitung sebagai "prompt" dalam periode lima jam, pada jam sibuk konsumsi dikalikan tiga, pada paket rendah hanya satu permintaan paralel, dan di Hacker News banyak yang mengeluhkan pemblokiran mendadak setelah hari kerja yang padat.
Kabar baiknya: ZCode secara resmi mendukung custom provider — Anda dapat menghubungkan API apa pun yang kompatibel dengan OpenAI atau Anthropic dan membayar berdasarkan token aktual, bukan kuota langganan. Dalam panduan ini, kita akan membahas apa itu ZCode dan bagaimana cara kerja GLM Coding Plan, kemudian kita akan mengonfigurasi ZCode langkah demi langkah ke JoinGonka Gateway — gateway jaringan terdesentralisasi Gonka, yang melayani GLM-5.3 Flash — model penalaran open-weight dari Z.ai sendiri. Hasilnya: alat yang sama, model open-weight yang sama, namun ekonominya berdasarkan token dan jauh lebih murah daripada API terpusat.
Apa itu ZCode: lingkungan pengembangan agen dari Z.ai
ZCode bukanlah «editor dengan sidebar chat», melainkan ADE: Anda mendeskripsikan tujuan, agen membuat rencana, mengedit file, menjalankan pemeriksaan, dan melakukan iterasi hingga hasil tercapai. Berfungsi sebagai aplikasi desktop di macOS dan Windows (build untuk Linux — dalam status beta).
Kemampuan utama versi 3.0:
- ZCode Agent — inti agen milik sendiri dengan integrasi mendalam GLM-5.2; selain itu, Anda dapat menghubungkan agen pihak ketiga (Claude Code, Codex, Gemini CLI, dan lainnya);
- Mode Goal (
/goal) — tugas otonom yang panjang: rencana → eksekusi → verifikasi langkah demi langkah; - Multi-agent — pengerjaan proyek secara paralel oleh beberapa agen;
- Kontrol jarak jauh — menjalankan dan mengontrol sesi dari Telegram, WeChat, dan Feishu: agen bekerja di mesin Anda, dan Anda menjawab pertanyaan dari ponsel.
Klien itu sendiri gratis, Z.ai memberikan kuota token GLM-5.2 harian kepada pengguna baru untuk perkenalan. Selanjutnya — bisa berlangganan GLM Coding Plan atau menggunakan kunci API Anda sendiri. Dan di sinilah kita perlu memahami detailnya, karena mekanisme langganan adalah bagian produk yang paling banyak dibicarakan.
GLM Coding Plan: harga, batasan, dan kuota
GLM Coding Plan adalah langganan Z.ai yang memberi akses ke model GLM di ZCode dan sekitar dua puluh alat pihak ketiga. Saat artikel ini terbit (Juli 2026), skema dasarnya seperti ini — tapi harga dan promo berubah, cek halaman live z.ai/subscribe:
| Paket | Harga, $/bulan | Kuota | Permintaan paralel |
|---|---|---|---|
| Lite | $18 (saat promo — mulai sekitar $12.6) | "Prompt" dalam jendela 5 jam + plafon mingguan | 1 |
| Pro | $72 | ×4 dari Lite | 1 |
| Max | $160 | ×16 dari Lite | hingga 30 |
Keluhan para pelanggan (thread Hacker News dan GitHub):
- Pengali jam sibuk. Di jam sibuk (14:00—18:00 UTC+8 — sore di Asia, pagi-siang di Eropa) setiap permintaan memotong kuota dengan koefisien ×3, di luar jam sibuk ×2. Perencanaan pemakaian harus mengikuti zona waktu Beijing.
- Kuota dalam "prompt", bukan token. Berapa token yang tersisa tidak transparan; di thread muncul cerita seperti "sudah pakai ~17M token di GLM — dan kena blokir empat hari".
- Satu permintaan paralel di Lite dan Pro. Untuk lingkungan agen ini terasa: mode multi-agent ZCode sendiri dan sub-agen paralel apa pun akan mengantre.
- GLM-5.2 menghabiskan kuota lebih cepat dari model yang lebih kecil — si flagship membakar limit dengan pengalinya sendiri.
Kesimpulannya sederhana: untuk solo developer yang santai, langganan ini benar-benar berfungsi. Tapi makin "agentic" caramu bekerja — tugas paralel, sesi otonom panjang, eksekusi malam — makin sering model kuota berubah jadi lotre. Alternatifnya — bayar token yang benar-benar terpakai: tanpa jendela, pengali, atau antrean — berapa yang dihabiskan agen, segitu yang dipotong. Model inilah yang ditawarkan mekanisme custom provider bawaan ZCode, dan pengaturannya cuma lima menit.
BYOK di ZCode: kunci API Anda sendiri dan custom provider
ZCode secara resmi mendukung BYOK: dokumentasinya secara eksplisit mengizinkan penambahan « layanan apa pun yang kompatibel dengan protokol OpenAI atau Anthropic » — API publik, kanal korporat, bahkan instalasi self-hosted. Konfigurasinya lewat tiga jalur:
- tombol Connect di layar selamat datang → « Set Your API Key »;
- Manage Models di pemilih model;
- ikon roda gigi → Settings → Model Settings → Add Provider.
Untuk penyedia, atur OpenAI Base URL dan/atau Anthropic Base URL plus API Key — ZCode akan menarik sendiri daftar model yang tersedia.
Tiga jebakan yang paling sering membuat orang tersandung:
- Endpoint Z.ai berbeda-beda. Langganan Coding Plan hanya berfungsi melalui coding-endpoint
https://api.z.ai/api/coding/paas/v4; endpoint umum/api/paas/v4dengan key langganan akan mengembalikan error — penyebab klasik « saya dapat 401/429 padahal paket sudah dibayar ». - « Berjalan di Claude Code ≠ berjalan di ZCode ». Variabel lingkungan seperti
ANTHROPIC_BASE_URLyang dipakai untuk mengonfigurasi Claude Code tidak dibaca oleh ZCode: ia punya penyimpanan konfigurasi penyedia sendiri. Konfigurasikan lewat Settings. - « Model terlihat di pemilih ≠ key punya kuota ». Daftar model ditarik dari API penyedia, tetapi ketersediaannya bergantung pada saldo dan limit key tersebut.
Selanjutnya praktik: hubungkan gateway JoinGonka ke ZCode dan dapatkan stack GLM dengan token.
Pengaturan JoinGonka Gateway di ZCode: GLM dengan token
JoinGonka Gateway — pintu gerbang ke jaringan terdesentralisasi Gonka dengan dua protokol asli: /v1/chat/completions yang kompatibel dengan OpenAI dan /v1/messages Anthropic. Ekonominya adalah pay-per-token: tidak ada jendela 5 jam, tidak ada pengali puncak ×3, dan tidak ada batas satu permintaan paralel; penggunaan terlihat di dasbor secara real-time, dan gateway tidak menyimpan konten prompt.
Langkah demi langkah (antarmuka Custom Provider saat ini):
| Langkah | Tindakan |
|---|---|
| 1. Kunci | Daftar — gate.joingonka.ai/register (akun baru mendapatkan 3M token gratis), buat kunci API di bagian Keys. Detail lebih lanjut di API Quick Start. |
| 2. Provider | ZCode → Settings → Model Settings → Add Provider. Nama: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. Kunci API | kunci Anda dalam bentuk jg-… |
| 5. Format API | Chat completions (/chat/completions) |
| 6. Model | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000. Anda juga dapat menambahkan MiniMaxAI/MiniMax-M2.7 dan zai-org/GLM-5.3-Flash — model penalaran dari Z.ai; daftar dan batas terkini ada di GET /v1/models. |
Pada versi ZCode lama, terdapat dua kolom terpisah: OpenAI Base URL (https://gate.joingonka.ai/v1) dan Anthropic Base URL (https://gate.joingonka.ai — path akan ditambahkan oleh klien secara otomatis).
Verifikasi: pilih model yang telah dibuat dan ajukan pertanyaan apa pun kepada agen. Jika jawaban muncul, semuanya berfungsi; jika terjadi error 401, periksa kunci, dan jika 402, periksa saldo akun. Jika muncul pesan «Model request failed» pada DeepSeek V4 Flash saat Thought Level diatur ke Max, ubah Thought Level ke High lalu ulangi permintaan.
Petunjuk. Perintah npx @joingonka/setup --tool zcode akan mencetak nilai siap pakai untuk kolom-kolom ini — base URL, kunci, ID model, dan batas aslinya (jendela konteks dan plafon respons) — serta memverifikasi dengan permintaan langsung apakah gateway menerimanya. ZCode hanya dapat dikonfigurasi melalui UI — tidak ada file yang aman untuk diedit, sehingga nilai harus dimasukkan secara manual.
Perbandingan harga: Coding Plan, Z.ai API, OpenRouter dan Gonka
Berapa biaya inferensi GLM di berbagai kanal (harga per 1M token; harga kompetitor dipatok per September 2026, harga JoinGonka diambil langsung ke halaman dari API gateway):
| Kanal | Input, $/1M | Output, $/1M | Model Pembayaran |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (input ter-cache — $0.26) | $4.40 | per token |
| GLM Coding Plan | $18—160/bln | langganan: kuota «prompt», multiplier ×3 saat puncak, batas paralelisme | |
| OpenRouter (z-ai/glm-5.2) | $1.40 | $4.40 | per token |
| OpenRouter (z-ai/glm-5.3-flash) | $0.09 | $0.30 | per token |
| JoinGonka Gateway | $0.0069 | $0.021 | per token, jaringan Gonka |
Perbedaan dua hingga tiga tingkat besaran bukanlah pembulatan pemasaran, melainkan ekonomi yang berbeda: perhitungan dilakukan oleh peserta jaringan desentralisasi yang memperoleh penghasilan dari pekerjaan itu sendiri, bukan dari margin pusat data. Penjelasan rinci tentang cara kerjanya dan batasan penerapannya ada di artikel tentang API AI termurah.
Baris JoinGonka adalah harga GLM-5.3 Flash di jaringan Gonka: semua model jaringan memiliki tarif yang sama. Angka di halaman ini diperbarui secara otomatis, Anda tidak perlu menghitung ulang secara manual.
GLM di jaringan Gonka: GLM-5.3 Flash dan FAQ
Jaringan Gonka melayani model Z.ai: zai-org/GLM-5.3-Flash diterima melalui proposal tata kelola #101 dan disalurkan oleh gateway setara dengan MiniMax M2.7 dan DeepSeek V4 Flash. Model unggulan GLM-5.2, yang dibahas dalam versi awal panduan ini, tidak masuk ke jajaran produksi — jaringan memilih model yang lebih ringan dan lebih cepat dari seri yang sama. Base URL dan kunci tetap sama: di ZCode, cukup tambahkan model sebagai custom provider.
Tentang modelnya: bobot terbuka di bawah lisensi MIT, arsitektur MoE dengan 320B parameter (18B aktif per token), atensi hibrida sparse dan linear. Fitur utamanya adalah model penalaran (reasoning-model): sebelum menjawab, ia melakukan penalaran, dan penalaran ini memakan beberapa ratus token bahkan untuk pertanyaan sederhana. Bagi ZCode, ini berarti dua hal: jangan menurunkan batas panjang jawaban model (mulai dari 600 token bahkan untuk balasan singkat) dan untuk pengeditan cepat, turunkan Thought Level — pada level API ini adalah reasoning_effort: low. Penjelasan rinci tentang model dan batasannya ada di artikel GLM-5.3 Flash di jaringan Gonka.
Pertanyaan umum:
- Mengapa ada kesalahan 429 atau antrean pada model baru? — Model saat ini dilayani oleh sebagian kecil host jaringan; pada menit puncak, permintaan mungkin harus menunggu slot kosong. Coba ulangi permintaan dalam beberapa detik — load balancer akan menemukan node yang tersedia. Status saat ini ada di halaman status gateway.
- Apa lagi yang tersedia? — Selain GLM-5.3 Flash, MiniMax M2.7 dan DeepSeek V4 Flash tersedia: ketiganya berfungsi di ZCode melalui custom provider yang sama, konfigurasi dari panduan ini sepenuhnya berfungsi.
- Bagaimana dengan privasi? — Gateway tidak menyimpan konten prompt dan jawaban; dalam statistik, hanya agregat konsumsi yang tersimpan.
- Kapan Coding Plan lebih menguntungkan? — Jika Anda bekerja solo, memenuhi kuota Lite, dan tidak menjalankan agen paralel, langganan dengan harga tetap lebih nyaman dan dapat diprediksi. Hitung sesuai profil Anda: dengan aktivitas agen yang intens, pembayaran per token melalui jaringan jauh lebih murah; untuk pengeditan kode ringan sesekali, perbedaannya mungkin tidak terasa.
- Apakah ini cocok untuk alat lain? — Ya: endpoint yang sama berfungsi di Claude Code, Cursor, Cline, dan klien yang kompatibel dengan OpenAI/Anthropic.
Ingin tahu lebih banyak?
Jelajahi bagian lain atau mulai hasilkan GNK sekarang.
Dapatkan token gratis →