Mga Seksyon ng Base ng Kaalaman ▾

Nabigasyon

▸ Magsimula rito Ayon sa papel

Mga Kategorya

Mga Gamit 52
Glosaryo 12

Mga Tool

Warp + JoinGonka Gateway — terminal agent sa iyong sariling endpoint

Ang Warp ay isang terminal na lumago bilang isang agent development environment: ang built-in na Warp Agent ay nagbabasa ng output ng command, nag-e-edit ng mga file, nagpapatakbo ng mga build, at gumagabay sa gawain mula sa request hanggang sa resulta. Bilang default, gumagana ang agent sa mga modelong ibinebenta mismo ng Warp — gamit ang mga credits ng plan, at ang pagdadala ng sariling inference ay matagal na posible lamang sa mga bayad na plan at sa pamamagitan lamang ng OpenAI, Anthropic, o Google key. Noong Mayo 20, 2026, binuksan ng Warp ang BYOK sa libreng plan at nagdagdag ng custom inference endpoint — koneksyon sa anumang serbisyong gumagamit ng OpenAI Chat Completions.

Ang pangalawang paraan ang kailangan upang patakbuhin ang Warp agent sa pamamagitan ng JoinGonka Gateway: ang gateway ay nagbibigay ng mga modelo ng desentralisadong network ng Gonka sa pamamagitan ng OpenAI-compatible API, ang inference ay binabayaran ayon sa live na presyo ng network, at para sa mga indibidwal at maliliit na team, hindi nababawasan ang kanilang Warp credits para dito. Pagkatapos ng pagpaparehistro at pag-verify ng address, makakatanggap ang account ng 3M libreng tokens — sapat na ito upang subukan ang agent sa iyong mga gawain bago ang unang top-up.

Sa ibaba ay ang mga kinakailangan bago magsimula, anong mga value ang ilalagay sa Warp form, kung paano masisiguro na ang mga request ay dumadaan sa gateway, anong network model ang pipiliin para sa mga terminal task, at kung ano ang mahalagang malaman tungkol sa route ng mga request: sa Warp, hindi ito gaya ng karamihan sa mga tool.

Mga kinakailangan: key, Warp plan, at public address

JoinGonka Key. Mag-register sa gateway, buksan ang seksyong "API-keys" sa dashboard, at i-click ang "Create key". Ang key ay nagsisimula sa jg- at ipinapakita nang isang beses lamang — i-save ito agad. Mas mainam na gumawa ng hiwalay na key para sa Warp: sa ganitong paraan, sa seksyong "Usage", ang pagkonsumo ng terminal agent ay makikita bilang hiwalay na linya, hindi nakahalo sa ibang mga tool.

Warp Plan. Ang sariling endpoint ay available hindi lamang sa mga bayad na plan — ang mga kundisyon ay nakadepende sa laki ng team:

Sino ang nagkokonektaAvailable ba ang sariling endpointAno ang mangyayari sa Warp credits
Isang developer o kumpanya na may hanggang 10 tao (Free, Build, Max plans)Oo, sa alinman sa mga plan na itoWalang binabawas na credits para sa inference sa pamamagitan ng sariling endpoint
Organisasyong may higit sa 10 taoBusiness o Enterprise lamangAng mga lokal na pagpapatakbo ng agent ay gumagamit ng platform credits — bayad para sa Warp infrastructure sa mas mababang rate; ang inference mismo ay binabayaran sa endpoint provider

Public HTTPS address. Ito ay requirement ng Warp na madaling makalimutan: ang mga request sa iyong endpoint ay hindi ipinapadala ng application sa iyong machine, kundi ng mga server ng Warp, kaya ang address ay dapat accessible mula sa internet. Ang localhost, 127.0.0.1, at mga private network address ay tinatanggihan ng form, at ang scheme na pinapayagan lamang ay https://. Ang JoinGonka Gateway ay isang public HTTPS service, kaya ang mga tunnel gaya ng ngrok, na inirerekomenda ng dokumentasyon ng Warp para sa mga lokal na modelo, ay hindi na kailangan dito.

Pinakabagong bersyon ng application. Ang sariling endpoint ay kasama sa stable build mula noong release ng Mayo 20, 2026, at ang pagpili ng API schema sa form ay lumabas noong Hulyo 31, 2026. Kung walang API schema field sa form — i-update ang Warp.

Pagkonekta: form ng Add custom endpoint

Ang buong setup ay ginagawa sa interface ng app — hindi na kailangang i-edit ang mga file nang manu-mano.

  1. Buksan ang Settings at i-type sa paghahanap ng settings ang inference endpoint — dadalhin ka ng Warp sa block na may mga key ng provider at sariling endpoint (nasa page ng settings ng Warp Agent ito).
  2. I-click ang Add custom endpoint — bubukas ang form.
  3. Punan ang mga field ng mga value mula sa talahanayan at i-click ang Add endpoint.
Field ng formAno ang ilalagayPaliwanag
API schemaOpenAI Chat CompletionsDefault na schema: para dito inilalarawan ng dokumentasyon ng Warp ang format ng address. Nasa listahan din ang OpenAI Responses at Anthropic Messages
Endpoint nameJoinGonkaKahit anong pangalan — sa ilalim nito makikita ang endpoint sa settings
Endpoint URLhttps://gate.joingonka.ai/v1Base address kasama ang /v1 — katulad ng halimbawa sa dokumentasyon ng Warp
API keyjg-your-keyNaka-store lang sa device, sa system key storage
Model namedeepseek-ai/DeepSeek-V4-Flash-0731Eksaktong identifier ng model, kung paano ito ibinibigay ng gateway
Model alias (optional)DeepSeek V4 FlashMaikling pangalan para sa model switcher

Ang button na + Add model ay nagdadagdag ng susunod na row. Idagdag agad ang lahat ng model ng network para makapag-switch sa pagitan nila nang hindi bumabalik sa settings: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 at zai-org/GLM-5.3-Flash. Ang aktwal na listahan ay laging ibinibigay ng GET https://gate.joingonka.ai/v1/models. Isulat ang mga identifier nang eksakto sa bawat karakter: ang form ay nagche-check lang ng hitsura ng address at kung puno ang mga field, hindi ito gumagawa ng test request kapag nagse-save, kaya ang typo sa pangalan ng model ay lalabas na sa dialogue kasama ang agent.

Pagkatapos i-save, lalabas ang mga model sa model switcher ng agent. Kung ang default na model ay nanatiling isa sa mga model ng Warp, maaaring mismo itong mag-alok na palitan ito — pumayag at piliin ang model ng iyong endpoint. Mahalagang detalye: ang mga opsyon na Auto sa switcher ay laging tumatakbo sa infrastructure ng Warp at gumagastos ng credits nito, kahit naka-setup ang sariling endpoint. Para pumunta ang request sa gateway, kailangang may napiling partikular na model mula sa iyong listahan sa switcher.

Pag-verify: kung dumadaan ba ang mga request sa gateway

Piliin sa switch ang modelo ng iyong endpoint at bigyan ang agent ng maikling gawain, halimbawa: «Ipakita ang limang pinakamalaking file sa kasalukuyang direktoryo at ipaliwanag ang command». Dapat magmungkahi ang agent ng command, isagawa ito nang may pahintulot mo, at magkomento sa output.

Ngayon, buksan ang dashboard ng gateway, seksyong «Paggamit». Sa blokeng «Ayon sa mga key», lalabas sa key na ginawa para sa Warp ang mga request at oras ng huling pag-access; sa blokeng «Ayon sa mga modelo» — ang napiling modelo. Dumarami ang counter — ibig sabihin, dumadaan ang inference sa JoinGonka Gateway, hindi sa mga credit ng Warp. Sa panig ng Warp, ipinapakita nito ang paggamit ng token sa mismong usapan kasama ang agent — sa ilalim ng maiikling pangalang itinakda mo sa field na alias.

Kung may naging mali, karaniwang mababasa ang dahilan sa tugon:

Ano ang nakikitaAno ang ibig sabihinAno ang gawin
401, Invalid API keyHindi nakilala ng gateway ang keyTingnan kung ang key ay nagsisimula sa jg-, naipasok nang walang espasyo, at aktibo sa seksyong «Mga API key»; kung may duda, gumawa ng bago
404, Invalid URL (POST …)May kalabisyong segment ang binuo na path; sa teksto ng error, ipinapakita ng gateway kung saan mismo dumating ang requestDapat maging /v1/chat/completions. Nadoble ang /v1 o napasok ang buong path sa address — ayusin ang Endpoint URL ayon sa anyo sa talahanayan sa itaas
405 Not Allowed o HTML na pahina sa halip na tugonNawawala ang /v1 sa address, dumaan ang request sa labas ng APIIdagdag ang /v1 sa dulo ng address
429Sobrang load ang modelo: sa peak hours, nauubos nang buo ang kapasidad ng isang partikular na modelo sa networkUlitin pagkalipas ng ilang segundo o lumipat sa katabing modelo — ito nga ang dahilan kung bakit sulit na gawin silang lahat nang sabay
Pumapasok ang mga request, pero nauubos ang credit ng WarpAuto o ang model router ng Warp ang napili sa switch, hindi ang modelo ng endpointPumili ng partikular na modelo mula sa iyong listahan
Hindi tinatanggap ng form ang addressKailangan ng Warp ang https:// at pampublikong hostIsulat ang buong address ng gateway, magsimula sa https://
«Hindi nakikita» ng modelo ang nakalakip na larawanText-based ang mga modelo ng network: pinapalitan ng gateway ang larawan ng tekstong talaPara sa mga gawaing may screenshot, lumipat sa modelong may vision; para sa mga command at code, manatili sa modelo ng network
Wala ang modelo ng endpoint sa cloud runLokal na nakatago ang sariling endpoint at hindi umaabot sa Cloud AgentsPatakbuhin ang gawain gamit ang lokal na agent

Maaaring may ilang segundong pagkaantala ang unang tugon sa session: nagpapadala ang agent ng malaking system prompt na may paglalarawan ng mga tool, at dumadaan muna ang request sa mga server ng Warp at pagkatapos sa node ng network. Pagkatapos, mas mabilis na ang usapan.

Anong modelo ang pipiliin para sa terminal agent

Ang presyo ng mga network model ay pare-pareho, kaya ang pagpili ay tungkol sa behavior, hindi sa budget. Ang terminal agent ay maraming binabasa (output ng command, logs, files) at patuloy na tumatawag ng mga tool; lahat ng modelo sa talahanayan ay sumusuporta sa native tool calling.

ModeloIdentifierContext at sagotKailan gagamitin sa Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, sagot hanggang 32768 tokensDefault na modelo para sa agent: mahahabang session, malalaking log at diff, pag-aayos sa maraming files. May extra sa context at pinakamataas na limitasyon sa sagot sa network
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, sagot hanggang 8192 tokensMabilis at maiikling task: maghanap ng command, mag-debug ng error, mag-ayos ng config
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, sagot hanggang 8192 tokensReasoning-modelo: nag-iisip bago sumagot. Komplikadong debugging, migration plan, pag-intindi sa hindi pamilyar na code; ang sagot ay dumarating nang mas huli, at bahagi ng limitasyon ay napupunta sa pag-iisip

Praktikal na scheme: DeepSeek V4 Flash — pangunahing modelo, MiniMax M2.7 — para sa maliliit na bagay, GLM-5.3 Flash — kapag ang task ay nakasalalay sa lohika, hindi sa dami. Ang pagpapalit ay tumatagal ng isang segundo dahil lahat ng modelo ay naka-set up na sa endpoint, at ang mga maikling pangalan mula sa alias field ay tumutulong upang hindi malito sa mahahabang identifier. Higit pang detalye tungkol sa pinakagamitin sa kanila — sa DeepSeek V4 Flash overview.

Magkano ang gastos nito

Ang agent sa terminal ay may mas mataas na konsumo ng token kaysa sa chat: sa bawat request, nagdaragdag ang Warp ng mga system instruction, context ng dialog, at description ng tools, at ang isang task ay binubuo ng ilang step. Kaya ang presyo bawat token dito ay mas mahalaga kaysa sa ordinaryong pag-uusap.

Sa pamamagitan ng JoinGonka Gateway, ang mga token ay nagkakahalaga ng $0.0069 bawat milyon sa input at $0.021 bawat milyon sa output — ang presyo ay pareho para sa lahat ng modelo ng network at kinukuha sa pahinang ito mula sa live source. Ang order ng mga halaga batay sa mga presyo noong Setyembre 2026:

ScenarioKonsumoSa pamamagitan ng Gateway
Isahang task: command at pag-analyze ng output nitosampu-sampung libong tokenfraction ng sentimo
Araw ng aktibong trabaho sa agent3-7M tokensilang sentimo
Buwan ng araw-araw na pagtatrabaho~150M tokensnasa isa hanggang dalawang dolyar

Para sa paghahambing — tatlong paraan ng pagbabayad sa Warp agent:

ParaanSino ang nagbibilang ng inferenceAno ang naglilimita
Warp modelsWarp, gamit ang plan creditsBuwanang supply ng plan credits
BYOK: OpenAI, Anthropic o Google keyVendor ng modelo ayon sa kanilang presyoPresyo bawat milyong token ng vendor
Sariling endpoint + JoinGonka GatewayGateway: ayon sa tokens, mula sa balanceBalance lamang: ang konsumo ay nakikita sa dashboard, walang quota sa bilang ng mga request

Ang Warp mismo ay hindi kumukuha ng credit para sa mga indibidwal at team na hanggang 10 tao na gumagamit ng sariling endpoint — babayaran lang ang mga token sa gateway. Ang balance ay pinupunan sa dashboard, kung saan makikita rin ang natitira at ang konsumo bawat araw at bawat modelo.

Route ng mga request at privacy: mga mahalagang malaman

Sa karamihan ng mga tool, ang sariling endpoint ay nangangahulugang «ang mga request ay direktang pumupunta mula sa aking machine patungo sa provider». Sa Warp ay iba: ang executing part ng agent ay tumatakbo sa mga server ng Warp, at ang sariling endpoint ay nagbabago lamang ng huling destinasyon at ng key. Ayon sa dokumentasyon ng Warp, ganito ang daloy ng request:

  1. Kinukuha ng application ang address ng endpoint at ang key mula sa secure storage sa device at ipinapadala ang mga ito sa mga server ng Warp kasama ng iyong prompt.
  2. Ang agent sa panig ng Warp ay bumubuo ng kumpletong request — system instructions, konteksto ng dialogue, mga tool — at tinatawag ang iyong endpoint gamit ang key na ito.
  3. Ang sagot ay ibinabalik sa application bilang stream sa pamamagitan ng parehong mga server.

Ano ang ibig sabihin nito sa praktika:

  • Key. Naka-imbak lamang ito sa device. Dumadaan ito sa mga server ng Warp sa bawat request, ngunit ayon sa pahayag ng Warp, hindi ito iniimbak doon: ginagamit ito on-the-fly at itinatapon pagkatapos.
  • Mga prompt at sagot. Dumadaan ang mga ito sa backend ng Warp. Ipinapahayag ng Warp na hindi nila ginagamit ang nilalamang ito para sa training, at ang storage at analytics ay sumasailalim sa mga setting ng privacy at telemetry ng iyong account. Ang garantiya ng ZDR, na umiiral para sa mga model ng mismong Warp, ay hindi nila mailalapat sa sariling endpoint: kung ano ang iniimbak ng provider ay nakadepende sa provider.
  • Panig ng gateway. Ang JoinGonka Gateway ay hindi nag-iimbak ng mga dialogue: ang mga prompt at sagot ay hindi naiiwan sa gateway pagkatapos ng sagot; sa dashboard, tanging ang mga counter ng mga request at token lamang ang nakikita.
  • Ano ang natitira sa imprastraktura ng Warp. Ang mga opsyon na Auto, user-defined model routers, Codebase Context, mga tip ng Active AI, at mga cloud agent — ang mga ito ay hindi naaapektuhan ng sariling endpoint.

Kung para sa iyong mga gawain ay hindi katanggap-tanggap ang pagdadaan sa mga server ng ibang tao, gumamit ng agent na direktang kumokonekta sa endpoint mula sa iyong machine — halimbawa, Codex CLI o anumang tool mula sa quick start para sa API. Mismong ang Warp sa anunsyo nito ay nangangako rin ng isang client version: isang magaan na agent module na nakasulat sa Rust sa isang open repository, na kumokonekta sa mga lokal na model nang hindi dumadaan sa mga server ng Warp, at may suporta para sa Agent Client Protocol. At simula sa release noong Setyembre 2, 2026, ang mga paglalarawan ng endpoint ay iniimbak sa isang configuration file sa format na ginagamit pareho ng application at ng Warp Agent CLI; ang mga key ay hindi napupunta sa file na ito at nananatili sa secure storage.

Ang Warp ay kumokonekta sa JoinGonka Gateway sa pamamagitan ng form na Add custom endpoint: scheme na OpenAI Chat Completions, address na https://gate.joingonka.ai/v1, key na jg- at mga identifier ng network model. Para sa mga indibidwal at team na hanggang 10 tao, available ito kahit sa libreng tier, at ang mga Warp credit para sa inference ay hindi nababawasan — kung ang napiling model sa switch ay endpoint, hindi Auto. Ang pangunahing tampok ng Warp ay ang ruta: ang mga request sa endpoint ay ipinapadala ng mga server nito, kaya dapat ay pampubliko ang address, at ang mga prompt ay dumadaan sa backend ng Warp bilang transit. Para sa mga terminal task, gamitin ang DeepSeek V4 Flash, para sa maliliit na bagay — MiniMax M2.7, para sa masalimuot na logic — GLM-5.3 Flash.

Gusto mo pang matuto?

Galugarin ang iba pang mga seksyon o simulang kumita ng GNK ngayon.

Kunin ang key at mga libreng token →