ส่วนของฐานความรู้ ▾
การนำทาง
▸ เริ่มต้นที่นี่ ตามบทบาทหมวดหมู่
- Cursor + Gonka AI - LLM ราคาถูกสำหรับการเขียนโค้ด
- Claude Code + Gonka AI - LLM สำหรับเทอร์มินัล
- OpenClaw + Gonka AI - เอเจนต์ AI ที่เข้าถึงได้
- OpenCode + Gonka AI - AI ฟรีสำหรับโค้ด
- Continue.dev + Gonka AI - AI สำหรับ VS Code/JetBrains
- Cline + Gonka AI - เอเจนต์ AI ใน VS Code
- Aider + Gonka AI - การเขียนโปรแกรมคู่กับ AI
- LangChain + Gonka AI - แอปพลิเคชัน AI ในราคาที่ถูกมาก
- n8n + Gonka AI - การทำงานอัตโนมัติด้วย AI ราคาถูก
- Open WebUI + Gonka AI - ChatGPT ของคุณเอง
- LibreChat + Gonka AI — open-source ChatGPT
- Hermes Agent + Gonka AI — agent อัตโนมัติในราคาถูก
- Kilo Code + Gonka AI — AI-agent ใน VS Code
- Roo Code + Gonka AI — AI-agent อัตโนมัติใน VS Code
- LlamaIndex + Gonka AI — แอป RAG ราคาถูก
- PydanticAI + Gonka — เอเจนต์ AI แบบมีไทป์ราคาถูก
- Vercel AI SDK + Gonka AI — แอปพลิเคชัน AI บน TypeScript ราคาถูก
- TanStack AI + Gonka — แอปพลิเคชัน AI บน TypeScript ราคาถูก
- API เริ่มต้นอย่างรวดเร็ว — curl, Python, TypeScript
- JoinGonka Gateway — ภาพรวมโดยละเอียด
- Management Keys — SaaS บน Gonka
- API AI ที่ถูกที่สุด: การเปรียบเทียบผู้ให้บริการปี 2026
- Cursor Pro ลิมิตคำขอหมด — วิเคราะห์ปัญหาและทางเลือกที่ถูกกว่า
- Claude Code ราคาประหยัดกว่า — วิเคราะห์บิลและการย้ายใช้งาน
- Cline เผาเงิน — ทำไมเอเจนต์ถึงใช้จ่ายเยอะเกินไป
- OpenClaw มีค่าใช้จ่ายสูง — ทำไมเอเจนต์ถึงใช้โทเค็นเปลืองและจะประหยัดได้อย่างไร
- OpenRouter: ทางเลือกราคาถูก — เปรียบเทียบกับ JoinGonka Gateway
- AI โมเดลที่ดีที่สุดสำหรับการเขียนโค้ดในปี 2026: เปรียบเทียบและราคา
- ทางเลือกราคาถูกแทนที่ GitHub Copilot แบบไม่จำกัด
- ทางเลือกราคาประหยัดสำหรับ Windsurf โดยไม่มีเครดิตหรือข้อจำกัด
- API ที่ถูกที่สุดสำหรับ AI-agent ในปี 2026
- ZCode: GLM-inferenced ราคาประหยัดแทนที่ GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — endpoint ของตัวเองแทนเครดิต
- GitHub Copilot BYOK — โมเดลของคุณเองแทนที่โควตา
- Zed + JoinGonka Gateway — อินเฟอเรนซ์ราคาประหยัดในโปรแกรมแก้ไข
- Pi + JoinGonka Gateway — เอเจนต์เทอร์มินัลบนอินเฟอเรนซ์ราคาถูก
เครื่องมือ
ZCode: GLM-inferenced ราคาประหยัดแทนที่ GLM Coding Plan
ในเดือนมิถุนายน 2026 Z.ai ได้เปิดตัว ZCode 3.0 ซึ่งเป็นสภาพแวดล้อมการพัฒนาแบบ Agent-based บนเดสก์ท็อป ที่ทางบริษัทเรียกว่า «Official Harness for GLM-5.2» ผลิตภัณฑ์ได้รับความสนใจอย่างรวดเร็วด้วย: เอ็นจิ้น Agent ในตัว, งานอิสระผ่าน /goal, โหมด multi-agent และการจัดการเซสชันระยะไกลผ่าน Telegram แต่เมื่อมีรีวิวออกมา ก็มีคำถามจากผู้ใช้ GLM Coding Plan รุ่นแรกๆ: โควตาถูกนับเป็น «prompts» ในรอบ 5 ชั่วโมง, ในชั่วโมงเร่งด่วนจะถูกหัก 3 เท่า, แผนเริ่มต้นรองรับการขอข้อมูลแบบขนานแค่หนึ่งรายการ และบน Hacker News มีการบ่นเกี่ยวกับการถูกบล็อกหลังจากทำงานหนัก
ข่าวดีคือ ZCode รองรับ custom provider อย่างเป็นทางการ คุณสามารถเชื่อมต่อ API ที่เข้ากันได้กับ OpenAI หรือ Anthropic และจ่ายเงินตามการใช้งานจริง (tokens) แทนที่จะจ่ายตามโควตาสมาชิก ในคู่มือนี้เราจะมาเจาะลึกว่า ZCode คืออะไร และ GLM Coding Plan ทำงานอย่างไร จากนั้นจะตั้งค่า ZCode ให้เชื่อมต่อกับ JoinGonka Gateway ซึ่งเป็นเกตเวย์ของเครือข่ายกระจายอำนาจ Gonka ที่เพิ่ม GLM-5.2 เข้ามาในรีจิสทรีแล้ว สรุปคือ: เครื่องมือเดิม, โมเดล open-weight เดิม แต่ประหยัดกว่าการใช้ API แบบรวมศูนย์หลายร้อยเท่า
ZCode คืออะไร: สภาพแวดล้อมการพัฒนารูปแบบ Agent จาก Z.ai
ZCode ไม่ใช่แค่ «ตัวแก้ไขโค้ดที่มีแชทข้างๆ» แต่เป็น ADE: คุณระบุเป้าหมาย เอเจนต์จะวางแผน แก้ไขไฟล์ เรียกใช้การทดสอบ และวนซ้ำจนกว่าจะได้ผลลัพธ์ ทำงานเป็นแอปพลิเคชันเดสก์ท็อปบน macOS และ Windows (เวอร์ชัน Linux อยู่ในสถานะเบต้า)
ความสามารถหลักของเวอร์ชัน 3.0:
- ZCode Agent — เอ็นจิ้นเอเจนต์ของตนเองที่รวมเข้ากับ GLM-5.2 อย่างลึกซึ้ง นอกจากนี้ยังรองรับเอเจนต์ภายนอกอื่นๆ (Claude Code, Codex, Gemini CLI และอื่นๆ)
- Goal-mode (
/goal) — งานอิสระระยะยาว: แผน → ดำเนินการ → ตรวจสอบเป็นขั้นตอน - Multi-agent — การทำงานแบบขนานของเอเจนต์หลายตัวในโปรเจกต์เดียวกัน
- การจัดการระยะไกล — เริ่มต้นและควบคุมเซสชันจาก Telegram, WeChat และ Feishu: เอเจนต์ทำงานบนเครื่องของคุณ แต่คุณตอบคำถามได้จากมือถือ
ไคลเอนต์นั้นฟรี โดย Z.ai มอบโควตาโทเค็น GLM-5.2 ให้ผู้ใช้ใหม่ทุกวันเพื่อทดลองใช้งาน หลังจากนั้นคุณต้องเลือกสมัคร GLM Coding Plan หรือใช้ API-key ของตนเอง และนี่คือจุดที่ต้องทำความเข้าใจ เพราะกลไกการรับสมาชิกเป็นส่วนที่ถูกพูดถึงมากที่สุดของผลิตภัณฑ์
GLM Coding Plan: ราคา ขีดจำกัด และโควตา
GLM Coding Plan คือสมาชิกแบบ Z.ai ที่ให้สิทธิ์เข้าถึงโมเดล GLM ใน ZCode และเครื่องมืออื่นๆ อีกกว่ายี่สิบรายการ ณ เวลาที่เผยแพร่ (กรกฎาคม 2026) โครงสร้างพื้นฐานมีดังนี้ (ราคาและโปรโมชั่นเปลี่ยนแปลงได้ โปรดตรวจสอบที่ z.ai/subscribe):
| แพ็กเกจ | ราคา $/เดือน | โควตา | การขอข้อมูลแบบขนาน |
|---|---|---|---|
| Lite | $18 (โปรโมชั่นเริ่มต้น ~$12.6) | «Prompts» ใน 5 ชั่วโมง + ขีดจำกัดรายสัปดาห์ | 1 |
| Pro | $72 | ×4 จาก Lite | 1 |
| Max | $160 | ×16 จาก Lite | สูงสุด 30 |
สิ่งที่ผู้ใช้บ่นกัน (จากกระทู้ Hacker News และ GitHub):
- ตัวคูณช่วงพีค ช่วงเวลาเร่งด่วน (14:00—18:00 UTC+8 — ช่วงเย็นในเอเชีย, ช่วงเช้า-บ่ายในยุโรป) ทุกคำขอจะหักโควตาด้วยตัวคูณ ×3, นอกช่วงเวลาหัก ×2 ต้องวางแผนการใช้งานตามโซนเวลาของปักกิ่ง
- โควตาคิดเป็น «prompts» ไม่ใช่โทเค็น จำนวนโทเค็นที่เหลืออยู่ไม่มีความโปร่งใส ในกระทู้มีเรื่องราวทำนองว่า «ใช้งาน ~17M tokens บน GLM แล้วถูกบล็อกเป็นเวลาสี่วัน»
- หนึ่งคำขอแบบขนาน สำหรับ Lite และ Pro สำหรับสภาพแวดล้อมแบบเอเจนต์ ถือว่ามีผลกระทบ: โหมด multi-agent ของ ZCode เองและย่อยๆ เอเจนต์จะเจอกับคิวรอ
- GLM-5.2 ใช้โควตาเร็วกว่า โมเดลขนาดเล็ก — ตัวท็อปจะกินโควตาด้วยตัวคูณของตัวเอง
สรุปง่ายๆ: สำหรับการพัฒนาคนเดียวทั่วไป สมาชิกทำงานได้ตามปกติ แต่ยิ่งโหมดการทำงานของคุณเป็น «เอเจนต์» มากเท่าไหร่ — งานขนาน, เซสชันอิสระยาวๆ, การประมวลผลช่วงกลางคืน — โมเดลโควตาก็จะยิ่งเหมือนการลุ้นหวย ทางเลือกคือการจ่ายตามการใช้งานจริง (tokens): ไม่มียอดรวมรอบ, ไม่มีการคูณ, ไม่มีคิว — ใช้ไปเท่าไหร่จ่ายเท่านั้น นี่คือโมเดลที่กลไก custom provider ในตัว ZCode มอบให้ และตั้งค่าได้ใน 5 นาที
BYOK ใน ZCode: API-key ของคุณเองและ custom provider
ZCode รองรับ BYOK อย่างเป็นทางการ: เอกสารระบุชัดเจนว่าสามารถเพิ่ม "บริการใดๆ ที่เข้ากันได้กับโปรโตคอลของ OpenAI หรือ Anthropic" เช่น public API, ช่องทางองค์กร หรือแม้แต่การติดตั้งแบบ self-hosted โดยสามารถตั้งค่าได้ 3 วิธี:
- ปุ่ม Connect บนหน้าจอ welcome → «Set Your API Key»;
- Manage Models ในตัวเลือกโมเดล;
- ไอคอนฟันเฟือง → Settings → Model Settings → Add Provider.
คุณต้องระบุ OpenAI Base URL และ/หรือ Anthropic Base URL พร้อมกับ API Key จากนั้น ZCode จะดึงรายชื่อโมเดลที่มีให้โดยอัตโนมัติ
ข้อผิดพลาดที่พบบ่อย 3 ประการ:
- Endpoint ของ Z.ai มีความแตกต่างกัน แผนการสมัครสมาชิก Coding Plan ทำงานผ่าน coding-endpoint:
https://api.z.ai/api/coding/paas/v4เท่านั้น; หากใช้/api/paas/v4ทั่วไปกับคีย์สมาชิกจะเกิดข้อผิดพลาด — นี่คือสาเหตุคลาสสิกของ "ฉันได้รับ 401/429 ทั้งที่จ่ายเงินแล้ว" - "ทำงานใน Claude Code ≠ ทำงานใน ZCode" ZCode จะไม่อ่าน Environment Variables เช่น
ANTHROPIC_BASE_URLที่ใช้ใน Claude Code: ZCode มีระบบเก็บการตั้งค่าของตัวเอง โปรดตั้งค่าผ่าน Settings เท่านั้น - "โมเดลปรากฏในรายการ ≠ คีย์นั้นมีโควตาอยู่" รายชื่อโมเดลจะถูกดึงมาจาก API ของผู้ให้บริการ แต่ความพร้อมใช้งานขึ้นอยู่กับยอดเงินคงเหลือและขีดจำกัดของคีย์นั้นๆ
ต่อไปคือวิธีใช้จริง: เชื่อมต่อ ZCode เข้ากับชัตเวย์ JoinGonka เพื่อรับ GLM-stack โดยจ่ายตามการใช้งานจริง (tokens)
การตั้งค่า JoinGonka Gateway ใน ZCode: GLM โดยจ่ายตามโทเค็น
JoinGonka Gateway คือประตูสู่เครือข่าย Gonka แบบกระจายศูนย์ด้วย 2 โปรโตคอล: OpenAI-compatible /v1/chat/completions และ Anthropic Messages /v1/messages โดยใช้โมเดลเศรษฐกิจแบบ pay-per-token: ไม่มีข้อจำกัด 5 ชั่วโมง ไม่มีตัวคูณช่วงพีค ×3 และไม่มีข้อจำกัดคำขอพร้อมกัน; คุณสามารถดูการใช้งานจริงได้ใน Dashboard และ Gateway ไม่มีการจัดเก็บเนื้อหาคำสั่ง (prompt) ของคุณ
ขั้นตอน (สำหรับอินเทอร์เฟซ Custom Provider ปัจจุบัน):
| ขั้นตอน | การดำเนินการ |
|---|---|
| 1. คีย์ | ลงทะเบียน — gate.joingonka.ai/register (บัญชีใหม่รับฟรี 10M tokens) สร้าง API-key ในส่วน Keys ดูรายละเอียดได้ที่ API Quick Start |
| 2. Provider | ZCode → Settings → Model Settings → Add Provider ชื่อ: JoinGonka |
| 3. Base URL | https://gate.joingonka.ai/v1 |
| 4. API Key | คีย์ของคุณรูปแบบ jg-… |
| 5. API format | Chat completions (/chat/completions) |
| 6. โมเดล | Add Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000 สามารถเพิ่ม moonshotai/Kimi-K2.6 และ MiniMaxAI/MiniMax-M2.7 ได้เช่นกัน รายการปัจจุบันตรวจสอบได้ที่ GET /v1/models |
สำหรับ ZCode เวอร์ชันเก่า จะมีสองช่องแยกกัน: OpenAI Base URL (https://gate.joingonka.ai/v1) และ Anthropic Base URL (https://gate.joingonka.ai — ตัวเครื่องมือจะเพิ่ม path ให้เอง)
การตรวจสอบ: เลือกโมเดลที่สร้างขึ้นและลองถามคำถาม หากได้รับคำตอบแสดงว่าทำงานได้ปกติ; หากเจอข้อผิดพลาด 401 ให้ตรวจสอบคีย์, 402 ให้ตรวจสอบยอดเงินในบัญชี หากใช้ DeepSeek V4 Flash แล้วเจอ "Model request failed" ในขณะตั้ง Thought Level เป็น Max ให้เปลี่ยนเป็น High แล้วลองอีกครั้ง
คำแนะนำ: คำสั่ง npx @joingonka/setup --tool zcode จะแสดงค่าที่จำเป็นสำหรับช่องด้านล่าง และตรวจสอบว่า Gateway ยอมรับคีย์หรือไม่ ZCode ต้องตั้งค่าผ่าน UI เท่านั้น ไม่มีไฟล์คอนฟิกที่แก้ไขได้โดยตรง
การเปรียบเทียบราคา: Coding Plan, Z.ai API, OpenRouter และ Gonka
ค่าใช้จ่ายในการทำ GLM-inferenced ผ่านช่องทางต่างๆ (ราคาต่อ 1M token; ของคู่แข่งอ้างอิงข้อมูล ณ กรกฎาคม 2026 ส่วนราคาของ JoinGonka จะดึงมาจาก API Gateway โดยตรง):
| ช่องทาง | ขาเข้า, $/1M | ขาออก, $/1M | รูปแบบการชำระเงิน |
|---|---|---|---|
| Z.ai API (GLM-5.2) | $1.40 (อินพุตแบบแคช — $0.26) | $4.40 | ตามจำนวน token |
| GLM Coding Plan | $18—160/เดือน | สมัครสมาชิก: โควตา "prompt", ตัวคูณ ×3 ในช่วงพีค, จำกัดการทำงานขนาน | |
| OpenRouter (z-ai/glm-5.2) | $0.93 | $3.00 | ตามจำนวน token; ไม่มีตัวเลือก GLM-5.2 แบบฟรี |
| JoinGonka Gateway | $0.0032 | $0.0097 | ตามจำนวน token, เครือข่าย Gonka |
ความแตกต่างระดับสองถึงสามเท่าไม่ได้มาจากการปัดเศษเพื่อการตลาด แต่มาจากระบบเศรษฐกิจที่ต่างออกไป: การคำนวณจะถูกทำโดยผู้เข้าร่วมในเครือข่ายแบบกระจายศูนย์ ซึ่งสร้างรายได้จากตัวงานโดยตรง ไม่ใช่จากส่วนต่างกำไรของศูนย์ข้อมูล สำหรับบทวิเคราะห์เชิงลึกเกี่ยวกับวิธีการทำงานและขอบเขตการใช้งาน สามารถอ่านได้ในบทความ เรื่อง AI API ที่ถูกที่สุด
คำเตือนเกี่ยวกับ GLM-5.2: ราคาจริงของโมเดลจะถูกกำหนดโดยเครือข่าย ณ เวลาที่เปิดใช้งาน (ในตารางข้างต้นคือราคาปัจจุบันของโมเดลในเครือข่าย) ตัวเลขบนหน้านี้จะอัปเดตอัตโนมัติ ไม่ต้องคำนวณใหม่เองด้วยมือ
GLM-5.2 ในเครือข่าย Gonka: สถานะและคำถามที่พบบ่อย
โมเดล zai-org/GLM-5.2-FP8 ได้ถูกเพิ่มลงใน on-chain registry ของเครือข่าย Gonka เรียบร้อยแล้ว: การตั้งค่ารองรับ context window สูงถึง 400K โทเค็น และตัวโมเดลเองถือเป็นโมเดลขนาดใหญ่ (ต้องใช้ VRAM มากกว่าหนึ่งเทราไบต์ต่อหนึ่ง replica) ขณะนี้อยู่ในระหว่างการเริ่มใช้งาน: โหนดของเครือข่ายกำลัง warm-up ค่า weight เมื่อการตรวจสอบเสร็จสมบูรณ์ โมเดลจะปรากฏในรายการโมเดลของ Gateway โดยอัตโนมัติ — base URL และคีย์ยังคงเหมือนเดิม ใน ZCode คุณเพียงแค่เลือกโมเดลจากตัวเลือกเท่านั้น
เกี่ยวกับตัวโมเดล: เป็น open-weight ภายใต้ใบอนุญาต MIT, สถาปัตยกรรม MoE ที่มีพารามิเตอร์ ~750B (ใช้งานจริงประมาณ 40B ต่อโทเค็น), รองรับ context window สูงถึง 1M โทเค็น ข้อมูลจาก Z.ai ระบุว่าบน SWE-bench Pro โมเดลทำคะแนนได้ 62.1 ซึ่งสูงกว่า GPT-5.5 และบน FrontierSWE ตามหลัง Claude Opus 4.8 เพียงประมาณหนึ่งเปอร์เซ็นต์ สำหรับ open-weight model นี่ถือเป็นอันดับต้นๆ ในด้านการเขียนโค้ด
คำถามที่พบบ่อย:
- ทำไมหลังจากเปิดโมเดลใหม่ถึงเจอ error 429? — นี่เป็นช่วงการเริ่มใช้งาน: บางโหนดกำลังโหลด weight อยู่ โปรดลองส่งคำขออีกครั้งหลังจากผ่านไปไม่กี่วินาที Load balancer จะหาโหนดที่พร้อมใช้งานให้คุณ
- วันนี้มีอะไรให้ใช้งานได้บ้าง? — Kimi K2.6, MiniMax M2.7 และ DeepSeek V4 Flash: ทั้งสามโมเดลทำงานใน ZCode ผ่าน custom provider ตัวเดิม การตั้งค่าในคู่มือนี้ใช้งานได้จริงทันที
- ความเป็นส่วนตัวเป็นอย่างไร? — Gateway ไม่เก็บเนื้อหาของ prompts และ responses ในสถิติจะมีเพียงข้อมูลสรุปการใช้งานเท่านั้น
- เมื่อไหร่ที่ Coding Plan ถึงจะคุ้มกว่า? — หากคุณทำงานคนเดียว อยู่ในโควตา Lite และไม่ได้รันเอเจนต์แบบขนาน การสมัครสมาชิกแบบจ่ายคงที่ก็สะดวกและคาดการณ์ได้ง่าย ให้คำนวณตามลักษณะการใช้งานของคุณ: หากทำงานด้านเอเจนต์อย่างหนัก การจ่ายตามการใช้จริงผ่านเครือข่ายจะถูกกว่ามาก แต่ถ้าแค่แก้ไขโค้ดเล็กน้อยวันละสองสามครั้ง ความแตกต่างอาจไม่ชัดเจนนัก
- รองรับเครื่องมืออื่นๆ หรือไม่? — ใช่: endpoint เดียวกันนี้ทำงานได้ใน Claude Code, Cursor, Cline และ client อื่นๆ ที่รองรับ OpenAI/Anthropic