Bagian Basis Pengetahuan ▾

Navigasi

▸ Mulai di sini Berdasarkan peran

Kategori

Alat 52
Glosarium 12

Perkakas

Warp + JoinGonka Gateway — agen terminal di endpoint Anda sendiri

Warp adalah terminal yang berkembang menjadi lingkungan pengembangan berbasis agen: agen Warp bawaan membaca output perintah, mengedit file, menjalankan build, dan mengelola tugas dari permintaan hingga hasil. Secara default, agen berjalan pada model yang dijual oleh Warp sendiri — menggunakan kredit paket — dan untuk waktu yang lama, membawa inference sendiri hanya bisa dilakukan di paket berbayar dengan kunci OpenAI, Anthropic, atau Google. Pada 20 Mei 2026, Warp membuka BYOK pada paket gratis dan menambahkan custom inference endpoint — koneksi ke layanan apa pun yang mendukung OpenAI Chat Completions.

Metode kedua ini diperlukan untuk menjalankan agen Warp melalui JoinGonka Gateway: gateway menyediakan model dari jaringan terdesentralisasi Gonka melalui API yang kompatibel dengan OpenAI, inference dibayar dengan harga pasar jaringan, dan bagi pengguna individu atau tim kecil, kredit Warp tidak akan terpotong untuk ini. Setelah pendaftaran dan verifikasi alamat, Anda akan menerima 3M token gratis di akun Anda — cukup untuk mencoba agen pada tugas Anda sebelum pengisian saldo pertama.

Di bawah ini adalah apa yang diperlukan sebelum memulai, nilai yang harus dimasukkan ke dalam formulir Warp, cara memastikan permintaan melalui gateway, model jaringan mana yang dipilih untuk tugas terminal, dan hal penting tentang rute permintaan: pada Warp, alurnya berbeda dari kebanyakan alat lainnya.

Apa yang diperlukan: kunci, paket Warp, dan alamat publik

Kunci JoinGonka. Daftar di gateway, buka bagian «API-keys» di dasbor, dan klik «Create key». Kunci dimulai dengan jg- dan hanya ditampilkan sekali — simpan segera. Disarankan untuk membuat kunci terpisah untuk Warp: dengan begitu, di bagian «Usage», penggunaan agen terminal akan terlihat di baris terpisah, tidak tercampur dengan alat lain.

Paket Warp. Endpoint Anda sendiri tersedia tidak hanya untuk paket berbayar — ketentuannya bergantung pada ukuran tim:

Siapa yang menghubungkanEndpoint kustom tersediaBagaimana dengan kredit Warp?
Pengembang individu atau perusahaan hingga 10 orang (paket Free, Build, Max)Ya, di paket mana punKredit tidak dipotong untuk inference melalui endpoint Anda
Organisasi lebih dari 10 orangHanya pada Business atau EnterpriseEksekusi lokal agen menggunakan platform credits — biaya infrastruktur Warp dengan tarif rendah; inference dibayarkan ke penyedia endpoint

Alamat HTTPS publik. Ini adalah persyaratan Warp yang sering terlewatkan: permintaan ke endpoint Anda tidak dikirim oleh aplikasi di mesin Anda, melainkan oleh server Warp, sehingga alamat tersebut harus dapat diakses dari internet. localhost, 127.0.0.1, dan alamat jaringan pribadi akan ditolak oleh formulir, dan hanya skema https:// yang diizinkan. JoinGonka Gateway adalah layanan HTTPS publik, jadi tunnel seperti ngrok, yang disarankan oleh dokumentasi Warp untuk model lokal, tidak diperlukan di sini.

Versi aplikasi terbaru. Endpoint kustom disertakan dalam build stabil sejak rilis 20 Mei 2026, dan pilihan skema API dalam formulir muncul pada rilis 31 Juli 2026. Jika bidang API schema tidak ada, perbarui Warp Anda.

Koneksi: formulir Add custom endpoint

Semua pengaturan dilakukan di antarmuka aplikasi — tidak perlu mengedit file secara manual.

  1. Buka Settings dan ketik inference endpoint di pencarian pengaturan — Warp akan membawa Anda ke blok berisi kunci penyedia dan endpoint Anda sendiri (blok ini ada di halaman pengaturan Warp Agent).
  2. Klik Add custom endpoint — formulir akan terbuka.
  3. Isi kolom dengan nilai dari tabel lalu klik Add endpoint.
Kolom formulirIsi denganPenjelasan
API schemaOpenAI Chat CompletionsSkema bawaan: justru untuk skema inilah dokumentasi Warp menjelaskan format alamatnya. Di daftar juga tersedia OpenAI Responses dan Anthropic Messages
Endpoint nameJoinGonkaNama bebas — dengan nama inilah endpoint terlihat di pengaturan
Endpoint URLhttps://gate.joingonka.ai/v1Alamat dasar beserta /v1 — sama seperti pada contoh di dokumentasi Warp
API keyjg-your-keyHanya disimpan di perangkat, di penyimpanan kunci sistem
Model namedeepseek-ai/DeepSeek-V4-Flash-0731ID model yang persis, sebagaimana diberikan oleh gateway
Model alias (optional)DeepSeek V4 FlashNama pendek untuk pengalih model

Tombol + Add model menambah baris berikutnya. Daftarkan sekaligus semua model jaringan agar nanti bisa berpindah di antara model-model itu tanpa kembali ke pengaturan: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7, dan zai-org/GLM-5.3-Flash. Daftar terbaru selalu diberikan oleh GET https://gate.joingonka.ai/v1/models. Masukkan ID karakter demi karakter: formulir hanya memeriksa bentuk alamat dan kelengkapan kolom, ia tidak melakukan permintaan uji saat menyimpan, jadi salah ketik pada nama model baru akan muncul saat berdialog dengan agen.

Setelah disimpan, model akan muncul di pengalih model agen. Jika model bawaan Anda masih salah satu model Warp, aplikasi bisa menawarkan sendiri untuk menggantinya — setujui dan pilih model dari endpoint Anda. Detail penting: opsi Auto di pengalih selalu berjalan di infrastruktur Warp dan menghabiskan kreditnya, bahkan ketika endpoint Anda sendiri sudah dikonfigurasi. Agar permintaan dikirim ke gateway, model tertentu dari daftar Anda harus dipilih di pengalih.

Pengecekan: apakah permintaan berjalan melalui gateway

Di pemilih, pilih model endpoint Anda lalu beri agen tugas singkat, misalnya: « Tampilkan lima file terbesar di direktori saat ini dan jelaskan perintahnya ». Agen harus mengusulkan perintah, menjalankannya setelah Anda mengizinkan, dan mengomentari hasilnya.

Sekarang buka dasbor gateway, bagian « Penggunaan ». Di blok « Berdasarkan kunci », kunci yang dibuat untuk Warp akan menampilkan permintaan dan waktu akses terakhir; di blok « Berdasarkan model », model yang dipilih. Jika penghitungnya naik, berarti inferensi berjalan lewat JoinGonka Gateway, bukan lewat kredit Warp. Di sisi lain, Warp menampilkan pemakaian token langsung di dialog dengan agen — dengan nama pendek yang Anda isi di kolom alias.

Kalau ada yang tidak beres, penyebabnya biasanya terbaca dari respons:

Yang terlihatArtinyaYang harus dilakukan
401, Invalid API keyGateway tidak mengenali kunciPastikan kunci diawali jg-, ditempel tanpa spasi, dan aktif di bagian « Kunci API »; kalau ragu, buat kunci baru
404, Invalid URL (POST …)Path tersusun dengan segmen berlebih; di teks error, gateway menunjukkan ke mana permintaan sebenarnya sampaiHasilnya harus /v1/chat/completions. Jika /v1 tergandakan atau alamat memuat path lengkap, kembalikan Endpoint URL ke bentuk pada tabel di atas
405 Not Allowed atau halaman HTML sebagai ganti responsAlamat kehilangan /v1, permintaan meleset dari APITambahkan /v1 di akhir alamat
429Model kelebihan beban: pada jam sibuk, kapasitas model tertentu di jaringan bisa terpakai habisCoba lagi beberapa detik kemudian atau beralih ke model tetangga — itulah alasan sebaiknya semua model disiapkan sekaligus
Permintaan lolos, tapi kredit Warp terkurasDi pemilih, yang terpilih adalah Auto atau router model Warp, bukan model endpointPilih model tertentu dari daftar Anda
Formulir menolak alamatWarp mensyaratkan https:// dan host publikIsikan alamat gateway secara lengkap, diawali https://
Model « tidak melihat » gambar yang dilampirkanModel di jaringan bersifat teks: gateway mengganti gambar dengan penanda teksUntuk tugas dengan tangkapan layar, beralih ke model bervisi; untuk perintah dan kode, tetap pakai model jaringan
Model endpoint tidak ada saat menjalankan di cloudEndpoint milik Anda disimpan secara lokal dan tidak berlaku untuk Cloud AgentsJalankan tugas dengan agen lokal

Respons pertama dalam sesi bisa tertunda beberapa detik: agen mengirim prompt sistem yang panjang berisi deskripsi alat, dan permintaan melewati server Warp lebih dulu lalu node jaringan. Setelah itu, dialog berjalan lebih cepat.

Model mana yang harus dipilih untuk agen terminal

Harga model-model jaringan ini sama, jadi pilihan di sini adalah tentang perilaku, bukan anggaran. Agen terminal membaca banyak (output perintah, log, file) dan terus-menerus memanggil alat; semua model dalam tabel mendukung native tool calling.

ModelIdentitasKonteks dan responsKapan menggunakan di Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, respons hingga 32768 tokenModel default untuk agen: sesi panjang, log dan diff besar, pengeditan di beberapa file. Cadangan konteks besar dan batas respons tertinggi di jaringan
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, respons hingga 8192 tokenTugas singkat yang cepat: mencari perintah, mengurai error, memperbaiki konfigurasi
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, respons hingga 8192 tokenModel penalaran: berpikir sebelum menjawab. Debugging rumit, rencana migrasi, membedah kode asing; respons datang lebih lambat dan sebagian batas respons digunakan untuk penalaran

Skema praktis: DeepSeek V4 Flash adalah model utama, MiniMax M2.7 untuk hal kecil, GLM-5.3 Flash saat tugas membutuhkan logika, bukan volume. Berpindah model hanya butuh satu detik karena semua sudah diatur di endpoint, dan nama pendek dari field alias mencegah kebingungan dengan identitas yang panjang. Detail lebih lanjut tentang yang paling populer tersedia di ulasan DeepSeek V4 Flash.

Berapa biayanya

Konsumsi token agen di terminal lebih tinggi daripada di obrolan: untuk setiap permintaan, Warp menambahkan instruksi sistem, konteks dialog, dan deskripsi alat, dan satu tugas terdiri dari beberapa langkah. Oleh karena itu, harga per token di sini lebih menentukan daripada korespondensi biasa.

Melalui JoinGonka Gateway, token berharga $0.0069 per juta untuk input dan $0.021 per juta untuk output — harga sama untuk semua model jaringan dan diambil di halaman ini dari sumber live. Perkiraan harga untuk September 2026:

SkenarioKonsumsiMelalui Gateway
Tugas tunggal: perintah dan penguraian output-nyapuluhan ribu tokenpecahan sen
Hari kerja aktif dengan agen3-7M tokenbeberapa sen
Bulan kerja harian~150M tokensekitar satu-dua dolar

Sebagai perbandingan, berikut tiga cara membayar agen Warp:

MetodeSiapa yang menghitung inferensiBatasan
Model WarpWarp, dengan kredit paketCadangan kredit bulanan paket
BYOK: kunci OpenAI, Anthropic atau GoogleVendor model sesuai tarifnyaHarga per juta token dari vendor
Endpoint sendiri + JoinGonka GatewayGateway: berdasarkan token, dari saldoHanya saldo: konsumsi terlihat di akun, tidak ada kuota jumlah permintaan

Warp sendiri tidak mengenakan biaya kredit untuk individu atau tim hingga 10 orang yang menggunakan endpoint sendiri — Anda hanya membayar token di gateway. Saldo diisi ulang di akun, di mana sisa dan konsumsi harian per model juga dapat dilihat.

Rute permintaan dan privasi: hal yang penting untuk diketahui

Bagi sebagian besar alat, endpoint kustom berarti "permintaan dikirim dari mesin saya langsung ke penyedia". Warp berbeda: bagian eksekusi agen berjalan di server Warp, dan endpoint kustom hanya mengubah tujuan akhir dan kunci. Menurut dokumentasi Warp, alur permintaannya adalah sebagai berikut:

  1. Aplikasi mengambil alamat endpoint dan kunci dari penyimpanan aman di perangkat dan mengirimkannya ke server Warp bersama dengan prompt Anda.
  2. Agen di sisi Warp mengumpulkan permintaan lengkap — instruksi sistem, konteks dialog, alat — dan memanggil endpoint Anda dengan kunci tersebut.
  3. Jawaban dikembalikan ke aplikasi melalui aliran (stream) melalui server yang sama.

Apa konsekuensinya dalam praktik:

  • Kunci. Disimpan hanya di perangkat. Kunci melewati server Warp pada setiap permintaan, tetapi menurut pernyataan Warp, kunci tersebut tidak disimpan di sana: digunakan secara langsung (on-the-fly) lalu dibuang.
  • Prompt dan jawaban. Melewati backend Warp. Warp menyatakan tidak menggunakan konten ini untuk pelatihan, dan penyimpanan serta analitik tunduk pada pengaturan privasi dan telemetri akun Anda. Jaminan ZDR, yang berlaku untuk model Warp sendiri, tidak dapat diperluas ke endpoint Anda: apa yang disimpan penyedia ditentukan oleh penyedia tersebut.
  • Sisi gateway. JoinGonka Gateway tidak menyimpan dialog: prompt dan jawaban tidak tetap ada di gateway setelah jawaban diberikan, di dasbor hanya terlihat penghitung permintaan dan token.
  • Apa yang tetap ada di infrastruktur Warp. Opsi Auto, perute model kustom, Codebase Context, saran Active AI, dan agen cloud — endpoint kustom tidak memengaruhi hal-hal ini.

Jika jalur melalui server pihak lain tidak dapat diterima untuk tugas Anda, gunakan agen yang mengakses endpoint langsung dari mesin Anda — misalnya, Codex CLI atau alat apa pun dari panduan memulai cepat API. Warp sendiri dalam pengumumannya menjanjikan varian klien: modul agen ringan dalam bahasa Rust di repositori terbuka, yang akan terhubung ke model lokal tanpa rute melalui server Warp, serta dukungan untuk Agent Client Protocol. Sejak rilis 2 September 2026, deskripsi endpoint disimpan dalam file pengaturan dengan format yang sama untuk aplikasi dan Warp Agent CLI; kunci tidak masuk ke dalam file ini dan tetap berada di penyimpanan aman.

Warp terhubung ke JoinGonka Gateway melalui formulir Add custom endpoint: skema OpenAI Chat Completions, alamat https://gate.joingonka.ai/v1, kunci jg- dan ID model jaringan. Untuk individu dan tim hingga 10 orang, ini tersedia bahkan pada paket gratis, dan kredit Warp tidak akan terpakai untuk inferensi jika model endpoint dipilih di pemilih alih-alih Auto. Fitur utama Warp adalah rutenya: permintaan ke endpoint dikirim oleh server Warp, sehingga alamat harus publik, dan prompt melewati backend Warp sebagai transit. Untuk tugas terminal, gunakan DeepSeek V4 Flash, untuk tugas kecil — MiniMax M2.7, untuk logika kompleks — GLM-5.3 Flash.

Ingin tahu lebih banyak?

Jelajahi bagian lain atau mulai hasilkan GNK sekarang.

Dapatkan kunci dan token gratis →