Mga Seksyon ng Base ng Kaalaman ▾
Nabigasyon
▸ Magsimula rito Ayon sa papelMga Kategorya
- Cursor + Gonka AI — Murang LLM para sa Coding
- Claude Code + Gonka AI — LLM para sa Terminal
- OpenClaw + Gonka AI — Abot-kayang AI Agents
- OpenCode: sariling modelo sa terminal
- Continue.dev + Gonka AI — AI para sa VS Code/JetBrains
- Cline + Gonka AI — AI Agent sa VS Code
- Aider + Gonka AI — Pair Programming na may AI
- LangChain + Gonka AI — Mga AI Applications sa Mababang Halaga
- n8n + Gonka AI — Automation na may Murang AI
- Open WebUI + Gonka AI — Ating ChatGPT
- LibreChat + Gonka AI — open-source ChatGPT
- Hermes Agent + DeepSeek sa Gonka network — awtonomong ahente sa murang halaga
- Kilo Code + Gonka AI — AI-agent sa VS Code
- Roo Code + Gonka AI — Autonomous na AI-Agent sa VS Code
- LlamaIndex + Gonka AI — Mga Aplikasyon ng RAG sa Maliit na Halaga
- PydanticAI + Gonka — Typed AI Agents sa Maliit na Halaga
- Vercel AI SDK + Gonka AI — AI Applications sa TypeScript sa Maliit na Halaga
- TanStack AI + Gonka — AI Applications sa TypeScript sa Maliit na Halaga
- API Mabilis na Pagsisimula — curl, Python, TypeScript
- JoinGonka Gateway — Buong Pangkalahatang-ideya
- Management Keys — SaaS sa Gonka
- Ang Pinakamurang AI API: Paghahambing ng mga Provider 2026
- Paano bumili ng AI tokens at API key: 3 paraan sa 2026
- Cursor Pro request limit naubos — pagsusuri at murang alternatibo
- Claude Code mas mura — pagsusuri ng bill at paglipat
- Nauubos ang pera sa Cline — bakit masyadong malakas gumastos ang agent
- Ang OpenClaw ay mahal — bakit inuubos ng agent ang mga token at paano makakatipid
- OpenRouter: murang alternatibo — paghahambing sa JoinGonka Gateway
- Pinakamahusay na AI-modelo para sa coding 2026: paghahambing at mga presyo
- Murang alternatibo sa GitHub Copilot nang walang limitasyon
- Murang alternatibo sa Windsurf na walang credits at limits
- Pinakamurang API para sa mga AI-agent sa 2026
- ZCode: murang GLM-inference kapalit ng GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — sariling endpoint imbes na credits
- GitHub Copilot BYOK — sariling mga modelo imbes na quota
- Zed + JoinGonka Gateway — murang inference sa editor
- Pi + JoinGonka Gateway — terminal agent sa murang inference
- Codex CLI: sariling key sa halip na subscription
- DeepSeek Harness: sariling provider sa pamamagitan ng JoinGonka Gateway
- MiniMax Code: MiniMax agent gamit ang sariling key via Gonka
- Warp + JoinGonka Gateway — terminal agent sa iyong sariling endpoint
- Trae + JoinGonka Gateway — mga Gonka network model sa AI-IDE
- Cherry Studio + JoinGonka Gateway — desktop AI client
- omp (Oh My Pi) + JoinGonka Gateway: agent na may mga model role
- OpenHands + JoinGonka Gateway: ahente sa sariling endpoint
- Qwen Code pagkatapos ng pagsasara ng qwen-oauth: pagtatrabaho sa pamamagitan ng JoinGonka Gateway
- Goose + JoinGonka Gateway: sariling provider at key sa keyring
- Crush + JoinGonka Gateway: Charm agent sa mga modelo ng network ng Gonka
- Zoo Code + JoinGonka Gateway: paglipat mula sa Roo Code patungo sa Gonka models
- Kimi Code CLI: Moonshot AI agent sa iyong sariling key sa pamamagitan ng Gonka
- Factory Droid + JoinGonka Gateway: BYOK sa mga modelo ng network ng Gonka
- MiMo Code + JoinGonka Gateway: Xiaomi agent sa mga Gonka network models
Mga Tool
ZCode: murang GLM-inference kapalit ng GLM Coding Plan
Noong Hunyo 2026, inilabas ng Z.ai ang ZCode 3.0 — isang desktop agentic development environment, na tinatawag ng kumpanya mismo bilang “Official Harness for GLM-5.2”. Mabilis na nakakuha ng atensyon ang produkto: sariling agentic core, mga autonomous task sa pamamagitan ng /goal, multi-agent mode, at remote session control direkta mula sa Telegram. Pero kasabay ng wave ng mga review ay ang wave ng mga tanong mula sa mga unang subscriber ng GLM Coding Plan: ang quota ay binibilang bilang “mga prompt” sa loob ng limang oras na window, sa peak hours ang konsumo ay multiplied ng tatlo, sa mga lower tier ay may isang parallel request, at sa Hacker News ay nagrereklamo sila tungkol sa biglaang pag-block pagkatapos ng isang abalang araw ng trabaho.
Ang magandang balita: Opisyal na sinusuportahan ng ZCode ang custom provider — maaari mong ikonekta ang anumang OpenAI- o Anthropic-compatible API dito at magbayad para sa mga aktwal na token sa halip na mga subscription quota. Sa gabay na ito, tatalakayin natin kung ano ang ZCode at kung paano gumagana ang GLM Coding Plan, at pagkatapos ay step-by-step na ikokonekta ang ZCode sa JoinGonka Gateway — ang gateway ng desentralisadong network ng Gonka na nagse-serve ng GLM-5.3 Flash, ang open reasoning model ng Z.ai mismo. Ang resulta: parehong tool, parehong open-weight na mga modelo, ngunit ang ekonomiya — ay per token at mas mura kaysa sa mga sentralisadong API.
Ano ang ZCode: agentic development environment mula sa Z.ai
Ang ZCode ay hindi isang «editor na may chat sidebar», kundi isang ADE: ilalarawan mo ang layunin, ang agent ay bubuo ng plano, magtatama ng files, magpapatakbo ng tests, at uulit hanggang sa makuha ang resulta. Gumagana ito bilang isang desktop application sa macOS at Windows (ang build para sa Linux ay nasa beta status pa).
Mga pangunahing kakayahan ng bersyon 3.0:
- ZCode Agent — sariling agent core na may malalim na integration ng GLM-5.2; bukod dito, maaari ring kumonekta ng third-party agents (Claude Code, Codex, Gemini CLI at iba pa);
- Goal-mode (
/goal) — mahabang autonomous tasks: plano → execution → step-by-step verification; - Multi-agent — sabay-sabay na pagtatrabaho ng maraming agents sa isang proyekto;
- Remote management — pagtakbo at pagkontrol ng sessions mula sa Telegram, WeChat, at Feishu: ang agent ay gumagana sa iyong machine, at sumasagot ka sa mga tanong mula sa iyong telepono.
Ang client mismo ay libre, binibigyan ng Z.ai ang mga bagong user ng daily quota ng GLM-5.2 tokens para masubukan. Pagkatapos nito — alinman sa mag-subscribe sa GLM Coding Plan o gumamit ng sariling API-key. Dito na kailangang intindihin ang mga detalye, dahil ang subscription model ang pinaka-pinag-uusapang parte ng produkto.
GLM Coding Plan: presyo, limitasyon, at quota
Ang GLM Coding Plan ay subscription ng Z.ai, na nagbibigay ng access sa GLM na mga modelo sa ZCode at sa dalawampung third-party na tool. Sa oras ng publikasyon (Hulyo 2026), ganito ang hitsura ng base na grid — ngunit nagbabago ang mga presyo at promo, i-verify sa live na pahina ng z.ai/subscribe:
| Plano | Presyo, $/buwan | Quota | Parallel na kahilingan |
|---|---|---|---|
| Lite | $18 (sa promo — mula ~$12.6) | «Prompt» sa 5-oras na window + linggong ceiling | 1 |
| Pro | $72 | ×4 sa Lite | 1 |
| Max | $160 | ×16 sa Lite | hanggang 30 |
Ang mga reklamo ng mga subscriber (mga thread sa Hacker News at GitHub):
- Peak multiplier. Sa peak hours (14:00—18:00 UTC+8 — gabi sa Asia, umaga-hapon sa Europa), bawat kahilingan ay nagbabawas ng quota sa ×3 na coefficient, sa labas ng peak — ×2. Kailangang planuhin ang gastos ayon sa Beijing time zone.
- Quota sa «prompt», hindi sa token. Kung gaano karaming token ang natitira — hindi transparent; sa mga thread may mga kuwento tulad ng «naka-consume ng ~17M token sa GLM — at nakatanggap ng 4-araw na block».
- Isang parallel na kahilingan sa Lite at Pro. Para sa agentic na kapaligiran, kapansin-pansin ito: ang multi-agent mode ng ZCode mismo at anumang parallel na sub-agent ay nabangga sa pila.
- Ang GLM-5.2 ay mas mabilis maubos ang quota kaysa sa mababang modelo — ang flagship ay naglalagay ng limitasyon sa sarili nitong multiplier.
Simple ang konklusyon: para sa tahimik na solo development, tapat na gumagana ang subscription. Ngunit kapag mas «agentic» ang iyong mode — parallel na gawain, mahabang autonomous na sesyon, panggabing pagpapatakbo — mas madalas na ang quota model ay nagiging lottery. Ang alternatibo — pagbabayad para sa aktwal na token: walang window, multiplier at pila — kung gaano ang ginastos ng agent, ganoon din ang ibinawas. Ito mismo ang modelong ibinibigay ng custom provider mechanism na built-in sa ZCode, at nase-set up ito sa limang minuto.
BYOK sa ZCode: sariling API-key at custom provider
Sa ZCode, opisyal na built-in ang suporta sa BYOK: ang dokumentasyon ay tahasang nagpapahintulot na magdagdag ng «anumang serbisyo na compatible sa OpenAI o Anthropic protocols» — mga pampublikong API, corporate channels, at kahit self-hosted installations. Nako-configure ito sa tatlong paraan:
- button na Connect sa welcome screen → «Set Your API Key»;
- Manage Models sa model selector;
- gear → Settings → Model Settings → Add Provider.
Ang provider ay binibigyan ng OpenAI Base URL at/o Anthropic Base URL kasama ang API Key — ang listahan ng available na mga modelo ay kusang hihilahin ng ZCode.
Tatlong madalas na pinagmumulan ng problema:
- Magkaiba ang mga endpoint ng Z.ai. Ang Coding Plan subscription ay gumagana lamang sa coding-endpoint na
https://api.z.ai/api/coding/paas/v4; ang pangkalahatang/api/paas/v4na may subscription key ay magbabalik ng error — klasikong dahilan ng «may 401/429 ako kahit bayad na ang plan». - «Gumagana sa Claude Code ≠ gumagana sa ZCode». Ang mga environment variable tulad ng
ANTHROPIC_BASE_URL, na ginagamit sa pag-configure ng Claude Code, ay hindi binabasa ng ZCode: may sarili itong storage ng settings ng mga provider. I-configure ito sa pamamagitan ng Settings. - «Nakikita ang modelo sa selector ≠ may quota ang key». Ang listahan ng mga modelo ay hinihilahin mula sa API ng provider, at ang availability ay depende sa balance at limits ng partikular na key.
Susunod — praktika: ikinokonekta namin sa ZCode ang JoinGonka gateway at nakakakuha ng GLM stack kapalit ng mga token.
Pag-configure ng JoinGonka Gateway sa ZCode: GLM kapalit ng mga token
JoinGonka Gateway — gateway patungo sa desentralisadong network ng Gonka na may dalawang native protocol: OpenAI-compatible /v1/chat/completions at Anthropic Messages /v1/messages. Ang ekonomiya ay pay-per-token: walang 5-oras na window, peak multipliers na ×3, at limitasyon na isang parallel request; ang konsumo ay makikita sa dashboard sa real-time, at ang nilalaman ng mga prompt ay hindi iniimbak ng gateway.
Step-by-step (kasalukuyang Custom Provider interface):
| Hakbang | Aksyon |
|---|---|
| 1. Key | Mag-register — gate.joingonka.ai/register (para sa mga bagong account — 3M libreng tokens), gumawa ng API-key sa section na Keys. Higit pang detalye — sa API Quick Start. |
| 2. Provider | ZCode → Settings → Model Settings → Add Provider. Name: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | iyong key na may format na jg-… |
| 5. API format | Chat completions (/chat/completions) |
| 6. Modelo | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000. Ganoon din ang pagdaragdag ng MiniMaxAI/MiniMax-M2.7 at zai-org/GLM-5.3-Flash — ang reasoning-model ng Z.ai; ang kasalukuyang listahan at limitasyon ay nasa GET /v1/models. |
Sa mga lumang bersyon ng ZCode, may dalawang hiwalay na field sa halip nito: OpenAI Base URL (https://gate.joingonka.ai/v1) at Anthropic Base URL (https://gate.joingonka.ai — idadagdag na mismo ng client ang path).
Pagsusuri: piliin ang ginawang modelo at magtanong sa agent ng kahit ano. Kung dumating ang sagot — gumagana ito; error 401 — suriin ang key, 402 — balanse ng account. Kung lumabas ang «Model request failed» sa DeepSeek V4 Flash habang nasa Thought Level Max — ilipat ang Thought Level sa High at ulitin ang request.
Tip. Ang command na npx @joingonka/setup --tool zcode ay magpi-print ng handang values para sa mga field na ito — base URL, key, model id, at ang totoong limitasyon nito: context window at response ceiling — at iva-validate nito sa pamamagitan ng live request kung tinatanggap ito ng gateway. Ang mismong ZCode ay sine-set up lamang sa pamamagitan ng UI — wala itong file na pwedeng i-edit nang ligtas, kaya kailangang manual na ilagay ang mga value.
Paghahambing ng presyo: Coding Plan, Z.ai API, OpenRouter at Gonka
Magkano ang GLM-inference sa iba't ibang channel (presyo bawat 1M tokens; ang sa mga kakumpitensya ay base sa Setyembre 2026, ang presyo ng JoinGonka ay awtomatikong kinukuha sa page mula sa gateway API):
| Channel | Input, $/1M | Output, $/1M | Modelo ng Pagbabayad |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (cached input — $0.26) | $4.40 | per token |
| GLM Coding Plan | $18—160/buwan | subscription: mga quota na «prompts», multiplier ×3 sa peak, parallel limits | |
| OpenRouter (z-ai/glm-5.2) | $1.40 | $4.40 | per token |
| OpenRouter (z-ai/glm-5.3-flash) | $0.09 | $0.30 | per token |
| JoinGonka Gateway | $0.0069 | $0.021 | per token, network ng Gonka |
Ang pagkakaiba ng dalawa hanggang tatlong order of magnitude ay hindi lamang marketing rounding, kundi ibang ekonomiya: ang mga kalkulasyon ay ginagawa ng mga kalahok sa desentralisadong network na kumikita sa mismong trabaho, at hindi sa margin ng data center. Ang detalyadong pagsusuri kung paano ito gumagana at kung saan ang mga hangganan nito — sa artikulo tungkol sa pinakamurang AI API.
Ang row ng JoinGonka ay presyo ng GLM-5.3 Flash sa network ng Gonka: ang lahat ng modelo sa network ay may iisang rate. Ang mga numero sa page na ito ay awtomatikong nag-a-update, hindi na kailangang mag-recalculate nang mano-mano.
GLM sa network ng Gonka: GLM-5.3 Flash at mga madalas itanong
Ang network ng Gonka ay nag-o-operate ng model na Z.ai: ang zai-org/GLM-5.3-Flash ay tinanggap ng governance-proposal #101 at ibinibigay ng gateway kasabay ng MiniMax M2.7 at DeepSeek V4 Flash. Ang flagship na GLM-5.2, na binanggit sa mga unang bersyon ng gabay na ito, ay hindi nakasama sa operational line-up — pinili ng network ang mas magaan at mas mabilis na modelo ng parehong linya. Ang Base URL at key ay pareho: sa ZCode, sapat na idagdag ang modelo sa custom provider.
Tungkol sa modelo mismo: open weights sa ilalim ng lisensyang MIT, architecture na MoE na may 320B parameters (18B active per token), hybrid sparse at linear attention. Ang pangunahing katangian ay isa itong reasoning-model: nag-iisip ito bago sumagot, at ang pag-iisip ay kumokonsumo ng ilang daang tokens kahit sa simpleng tanong. Para sa ZCode, nangangahulugan ito ng dalawang bagay: huwag babaan ang limitasyon sa haba ng sagot ng modelo (mula 600 tokens kahit para sa maiikling sagot) at para sa mabilisang pag-edit, babaan ang Thought Level — sa API level ito ay reasoning_effort: low. Detalyadong pagsusuri ng modelo at ang mga limitasyon nito ay nasa artikulong GLM-5.3 Flash sa Gonka network.
Mga Madalas Itanong:
- Bakit may 429 o queue sa bagong modelo? — Ang modelo ay sineserbisyuhan pa lamang ng maliit na bahagi ng mga host ng network; sa mga peak minute, ang mga request ay maaaring maghintay ng bakanteng slot. Ulitin ang request pagkalipas ng ilang segundo — hahanap ang balancer ng active node. Ang kasalukuyang estado ay nasa pahina ng status ng gateway.
- Ano pa ang available? — Bukod sa GLM-5.3 Flash — MiniMax M2.7 at DeepSeek V4 Flash: ang tatlong modelo ay gumagana sa ZCode sa pamamagitan ng parehong custom provider, ang configuration mula sa gabay na ito ay ganap na gumagana.
- Kumusta naman ang privacy? — Hindi iniimbak ng gateway ang nilalaman ng mga prompt at sagot; sa statistics, ang mga aggregate ng paggamit lamang ang nakikita.
- Kailan mas sulit ang Coding Plan? — Kung solo kang nagtatrabaho, pasok ka sa Lite quota at hindi nagpapatakbo ng mga parallel agent, ang subscription na may fixed rate ay maginhawa at predictable. Mag-compute batay sa iyong profile: sa aktibong agentic work, ang bayad sa tokens sa pamamagitan ng network ay mas mura nang hamak, sa light code editing ilang beses sa isang araw, maaaring hindi maramdaman ang pagkakaiba.
- Bagay ba ito sa ibang mga tool? — Oo: ang parehong endpoint ay gumagana sa Claude Code, Cursor, Cline at anumang OpenAI/Anthropic-compatible client.
Gusto mo pang matuto?
Galugarin ang iba pang mga seksyon o simulang kumita ng GNK ngayon.
Kumuha ng libreng tokens →