ส่วนของฐานความรู้ ▾

การนำทาง

▸ เริ่มต้นที่นี่ ตามบทบาท

หมวดหมู่

เครื่องมือ 52
อภิธานศัพท์ 12

เครื่องมือ

ZCode: GLM-inferenced ราคาประหยัดแทนที่ GLM Coding Plan

ในเดือนมิถุนายน 2026 Z.ai ได้เปิดตัว ZCode 3.0 — สภาพแวดล้อมการพัฒนาแบบเอเจนต์บนเดสก์ท็อป ซึ่งบริษัทเองเรียกว่าเป็น "Official Harness for GLM-5.2" ผลิตภัณฑ์นี้ได้รับความสนใจอย่างรวดเร็ว ด้วยเอเจนต์คอร์ของตนเอง, งานอิสระผ่าน /goal, โหมด multi-agent และการจัดการเซสชันระยะไกลผ่าน Telegram โดยตรง แต่พร้อมกับกระแสรีวิว ก็มีคำถามจากผู้ใช้ช่วงแรกของ GLM Coding Plan ว่าโควตานับเป็น "prompts" ในกรอบเวลาห้าชั่วโมง, ในช่วงชั่วโมงเร่งด่วนค่าใช้จ่ายจะคูณสาม, ในแผนเริ่มต้นจะมีคำขอแบบขนานได้เพียงรายการเดียว และมีเสียงบ่นบน Hacker News เกี่ยวกับการถูกบล็อกกะทันหันหลังจากทำงานหนักมาทั้งวัน

ข่าวดีคือ ZCode รองรับ custom provider อย่างเป็นทางการ — คุณสามารถเชื่อมต่อ API ใดก็ได้ที่รองรับ OpenAI หรือ Anthropic และจ่ายเงินตามโทเค็นจริงแทนการใช้โควตาแบบสมัครสมาชิก ในคู่มือนี้เราจะดูว่า ZCode คืออะไรและ GLM Coding Plan ทำงานอย่างไร จากนั้นจะตั้งค่า ZCode ให้เชื่อมต่อกับ JoinGonka Gateway ซึ่งเป็นเกตเวย์ของเครือข่ายกระจายศูนย์ Gonka ที่ให้บริการ GLM-5.3 Flash ซึ่งเป็นโมเดล reasoning แบบ open-weight ของ Z.ai เอง ผลลัพธ์ที่ได้: เครื่องมือเดิม โมเดล open-weight เดิม แต่ใช้เศรษฐศาสตร์แบบจ่ายตามโทเค็นและถูกกว่า API แบบรวมศูนย์หลายเท่า

ZCode คืออะไร: สภาพแวดล้อมการพัฒนารูปแบบ Agent จาก Z.ai

ZCode ไม่ใช่แค่ «ตัวแก้ไขโค้ดที่มีแชทข้างๆ» แต่เป็น ADE: คุณระบุเป้าหมาย เอเจนต์จะวางแผน แก้ไขไฟล์ เรียกใช้การทดสอบ และวนซ้ำจนกว่าจะได้ผลลัพธ์ ทำงานเป็นแอปพลิเคชันเดสก์ท็อปบน macOS และ Windows (เวอร์ชัน Linux อยู่ในสถานะเบต้า)

ความสามารถหลักของเวอร์ชัน 3.0:

  • ZCode Agent — เอ็นจิ้นเอเจนต์ของตนเองที่รวมเข้ากับ GLM-5.2 อย่างลึกซึ้ง นอกจากนี้ยังรองรับเอเจนต์ภายนอกอื่นๆ (Claude Code, Codex, Gemini CLI และอื่นๆ)
  • Goal-mode (/goal) — งานอิสระระยะยาว: แผน → ดำเนินการ → ตรวจสอบเป็นขั้นตอน
  • Multi-agent — การทำงานแบบขนานของเอเจนต์หลายตัวในโปรเจกต์เดียวกัน
  • การจัดการระยะไกล — เริ่มต้นและควบคุมเซสชันจาก Telegram, WeChat และ Feishu: เอเจนต์ทำงานบนเครื่องของคุณ แต่คุณตอบคำถามได้จากมือถือ

ไคลเอนต์นั้นฟรี โดย Z.ai มอบโควตาโทเค็น GLM-5.2 ให้ผู้ใช้ใหม่ทุกวันเพื่อทดลองใช้งาน หลังจากนั้นคุณต้องเลือกสมัคร GLM Coding Plan หรือใช้ API-key ของตนเอง และนี่คือจุดที่ต้องทำความเข้าใจ เพราะกลไกการรับสมาชิกเป็นส่วนที่ถูกพูดถึงมากที่สุดของผลิตภัณฑ์

GLM Coding Plan: ราคา ขีดจำกัด และโควตา

GLM Coding Plan คือสมาชิกแบบ Z.ai ที่ให้สิทธิ์เข้าถึงโมเดล GLM ใน ZCode และเครื่องมืออื่นๆ อีกกว่ายี่สิบรายการ ณ เวลาที่เผยแพร่ (กรกฎาคม 2026) โครงสร้างพื้นฐานมีดังนี้ (ราคาและโปรโมชั่นเปลี่ยนแปลงได้ โปรดตรวจสอบที่ z.ai/subscribe):

แพ็กเกจราคา $/เดือนโควตาการขอข้อมูลแบบขนาน
Lite$18 (โปรโมชั่นเริ่มต้น ~$12.6)«Prompts» ใน 5 ชั่วโมง + ขีดจำกัดรายสัปดาห์1
Pro$72×4 จาก Lite1
Max$160×16 จาก Liteสูงสุด 30

สิ่งที่ผู้ใช้บ่นกัน (จากกระทู้ Hacker News และ GitHub):

  • ตัวคูณช่วงพีค ช่วงเวลาเร่งด่วน (14:00—18:00 UTC+8 — ช่วงเย็นในเอเชีย, ช่วงเช้า-บ่ายในยุโรป) ทุกคำขอจะหักโควตาด้วยตัวคูณ ×3, นอกช่วงเวลาหัก ×2 ต้องวางแผนการใช้งานตามโซนเวลาของปักกิ่ง
  • โควตาคิดเป็น «prompts» ไม่ใช่โทเค็น จำนวนโทเค็นที่เหลืออยู่ไม่มีความโปร่งใส ในกระทู้มีเรื่องราวทำนองว่า «ใช้งาน ~17M tokens บน GLM แล้วถูกบล็อกเป็นเวลาสี่วัน»
  • หนึ่งคำขอแบบขนาน สำหรับ Lite และ Pro สำหรับสภาพแวดล้อมแบบเอเจนต์ ถือว่ามีผลกระทบ: โหมด multi-agent ของ ZCode เองและย่อยๆ เอเจนต์จะเจอกับคิวรอ
  • GLM-5.2 ใช้โควตาเร็วกว่า โมเดลขนาดเล็ก — ตัวท็อปจะกินโควตาด้วยตัวคูณของตัวเอง

สรุปง่ายๆ: สำหรับการพัฒนาคนเดียวทั่วไป สมาชิกทำงานได้ตามปกติ แต่ยิ่งโหมดการทำงานของคุณเป็น «เอเจนต์» มากเท่าไหร่ — งานขนาน, เซสชันอิสระยาวๆ, การประมวลผลช่วงกลางคืน — โมเดลโควตาก็จะยิ่งเหมือนการลุ้นหวย ทางเลือกคือการจ่ายตามการใช้งานจริง (tokens): ไม่มียอดรวมรอบ, ไม่มีการคูณ, ไม่มีคิว — ใช้ไปเท่าไหร่จ่ายเท่านั้น นี่คือโมเดลที่กลไก custom provider ในตัว ZCode มอบให้ และตั้งค่าได้ใน 5 นาที

BYOK ใน ZCode: API-key ของคุณเองและ custom provider

ZCode รองรับ BYOK ในตัวอย่างเป็นทางการ: เอกสารระบุชัดเจนว่าสามารถเพิ่ม «บริการใด ๆ ที่รองรับโปรโตคอล OpenAI หรือ Anthropic» — public API, ช่องทางองค์กร และแม้แต่การติดตั้งแบบ self-hosted ตั้งค่าได้สามวิธี:

  • ปุ่ม Connect บน welcome screen → «Set Your API Key»;
  • Manage Models ในตัวเลือกโมเดล;
  • ไอคอนเฟือง → Settings → Model Settings → Add Provider

ผู้ให้บริการต้องตั้งค่า OpenAI Base URL และ/หรือ Anthropic Base URL พร้อม API Key — ZCode จะดึงรายการโมเดลที่ใช้ได้เอง

สามจุดที่คนพลาดบ่อยที่สุด:

  • Endpoint ของ Z.ai แตกต่างกัน การสมัคร Coding Plan ใช้ได้เฉพาะผ่าน coding-endpoint https://api.z.ai/api/coding/paas/v4; ส่วน /api/paas/v4 ทั่วไปกับ key แบบสมัครสมาชิกจะคืน error — นี่คือสาเหตุคลาสสิกของ «ทำไมได้ 401/429 ทั้งที่จ่าย plan แล้ว»
  • «ใช้ได้ใน Claude Code ≠ ใช้ได้ใน ZCode» ตัวแปรสภาพแวดล้อมอย่าง ANTHROPIC_BASE_URL ที่ใช้ตั้งค่า Claude Code ZCode ไม่ได้อ่าน: มันมีที่เก็บการตั้งค่าผู้ให้บริการของตัวเอง ตั้งค่าผ่าน Settings เท่านั้น
  • «เห็นโมเดลในตัวเลือก ≠ key มีโควตา» รายการโมเดลดึงจาก API ของผู้ให้บริการ แต่การเข้าถึงขึ้นอยู่กับยอดคงเหลือและขีดจำกัดของ key แต่ละอัน

ต่อไปคือภาคปฏิบัติ: เชื่อมต่อ JoinGonka Gateway เข้ากับ ZCode แล้วใช้ GLM stack ด้วย tokens

การตั้งค่า JoinGonka Gateway ใน ZCode: GLM โดยจ่ายตามโทเค็น

JoinGonka Gateway — เกตเวย์สู่เครือข่ายแบบกระจายศูนย์ Gonka พร้อมโปรโตคอลเนทีฟ 2 ตัว: /v1/chat/completions ที่รองรับ OpenAI และ /v1/messages สำหรับ Anthropic Messages โมเดลเศรษฐกิจคือ pay-per-token: ไม่มีหน้าต่าง 5 ชั่วโมง, ตัวคูณสูงสุด ×3 หรือจำกัดการร้องขอขนานเพียงหนึ่งเดียว; คุณสามารถดูการใช้งานแบบเรียลไทม์ได้ในแดชบอร์ด และเกตเวย์ไม่เก็บเนื้อหาของพรอมต์ไว้

ขั้นตอน (อินเทอร์เฟซ Custom Provider ปัจจุบัน):

ขั้นตอนการดำเนินการ
1. คีย์ลงทะเบียนที่ — gate.joingonka.ai/register (บัญชีใหม่รับ 3M โทเค็นฟรี), สร้าง API-key ในส่วน Keys ดูรายละเอียดเพิ่มเติมที่ API Quick Start
2. ผู้ให้บริการZCode → Settings → Model Settings → Add Provider ชื่อ: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyคีย์ของคุณในรูปแบบ jg-…
5. รูปแบบ APIChat completions (/chat/completions)
6. โมเดลAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000 นอกจากนี้ยังเพิ่ม MiniMaxAI/MiniMax-M2.7 และ zai-org/GLM-5.3-Flash ซึ่งเป็นโมเดล reasoning ของ Z.ai เองได้ ดูรายการปัจจุบันและขีดจำกัดที่ — GET /v1/models

ใน ZCode เวอร์ชันเก่าจะมีฟิลด์แยกกันสองฟิลด์แทน: OpenAI Base URL (https://gate.joingonka.ai/v1) และ Anthropic Base URL (https://gate.joingonka.ai — ไคลเอ็นต์จะเพิ่ม path ให้อัตโนมัติ)

การตรวจสอบ: เลือกโมเดลที่สร้างขึ้นและถามคำถามกับเอเจนต์ หากได้รับคำตอบแสดงว่าทำงานได้ปกติ; หากเจอข้อผิดพลาด 401 ให้ตรวจสอบคีย์, 402 คือยอดเงินในบัญชีไม่พอ หากบน DeepSeek V4 Flash เกิดข้อผิดพลาด «Model request failed» ขณะตั้งค่า Thought Level เป็น Max — ให้เปลี่ยนเป็น High แล้วลองอีกครั้ง

เคล็ดลับ: คำสั่ง npx @joingonka/setup --tool zcode จะพิมพ์ค่าที่พร้อมใช้สำหรับฟิลด์เหล่านี้ ได้แก่ base URL, คีย์, ID โมเดล และขีดจำกัดจริง (หน้าต่างบริบทและเพดานคำตอบ) พร้อมทั้งทดสอบด้วยการร้องขอจริงว่าเกตเวย์ยอมรับค่าเหล่านั้นหรือไม่ ZCode ปรับแต่งได้ผ่าน UI เท่านั้น ไม่มีไฟล์ที่แก้ไขได้อย่างปลอดภัย คุณจึงต้องใส่ค่าด้วยตนเอง

การเปรียบเทียบราคา: Coding Plan, Z.ai API, OpenRouter และ Gonka

ค่าใช้จ่ายของ GLM-inference ในช่องทางต่างๆ (ราคาต่อ 1M token; ของคู่แข่งอ้างอิงข้อมูล ณ เดือนกันยายน 2026 ราคาของ JoinGonka จะดึงมาจาก API ของเกตเวย์โดยตรง):

ช่องทางขาเข้า, $/1Mขาออก, $/1Mรูปแบบการชำระเงิน
Z.ai API (GLM-5.2)$1.40 (cached input — $0.26)$4.40ตามการใช้งาน
GLM Coding Plan$18—160/เดือนสมัครสมาชิก: โควต้าตาม "prompts", ตัวคูณ ×3 ช่วงพีค, จำกัดจำนวนงานขนาน
OpenRouter (z-ai/glm-5.2)$1.40$4.40ตามการใช้งาน
OpenRouter (z-ai/glm-5.3-flash)$0.09$0.30ตามการใช้งาน
JoinGonka Gateway$0.0069$0.021ตามการใช้งาน, เครือข่าย Gonka

ความแตกต่างสองถึงสามเท่าไม่ใช่การตลาด แต่เป็นเศรษฐศาสตร์ที่แตกต่างกัน: งานประมวลผลถูกดำเนินการโดยผู้เข้าร่วมเครือข่ายกระจายอำนาจ ซึ่งได้รับผลตอบแทนจากการทำงานจริง ไม่ใช่จากส่วนต่างกำไรของศูนย์ข้อมูล สามารถอ่านบทวิเคราะห์โดยละเอียดเกี่ยวกับวิธีการทำงานและขอบเขตการใช้งานได้ในบทความ เกี่ยวกับ AI API ที่ถูกที่สุด

แถวของ JoinGonka คือราคาของ GLM-5.3 Flash ในเครือข่าย Gonka: ทุกโมเดลในเครือข่ายมีอัตราค่าบริการเดียวกัน ตัวเลขในหน้านี้จะอัปเดตอัตโนมัติ ไม่ต้องคำนวณใหม่ด้วยตนเอง

GLM ในเครือข่าย Gonka: GLM-5.3 Flash และคำถามที่พบบ่อย

เครือข่าย Gonka ให้บริการโมเดล Z.ai: zai-org/GLM-5.3-Flash ซึ่งผ่านการรับรองโดย governance-proposal #101 และให้บริการผ่านเกตเวย์เทียบเท่ากับ MiniMax M2.7 และ DeepSeek V4 Flash โดยโมเดลเรือธงอย่าง GLM-5.2 ที่เคยกล่าวถึงในคู่มือเวอร์ชันแรกนั้นไม่ได้ถูกนำมาใช้จริง เนื่องจากเครือข่ายเลือกโมเดลที่เบาและเร็วกว่าในตระกูลเดียวกัน Base URL และคีย์ยังคงเหมือนเดิม: ใน ZCode เพียงแค่เพิ่มโมเดลเข้าไปใน custom provider

เกี่ยวกับตัวโมเดล: เป็นโมเดล open weights ภายใต้ใบอนุญาต MIT, สถาปัตยกรรม MoE ขนาด 320B พารามิเตอร์ (18B พารามิเตอร์ต่อโทเค็น) พร้อมระบบผสมผสานระหว่าง sparse และ linear attention จุดเด่นหลักคือเป็น reasoning-model: มันจะใช้เวลาคิดก่อนตอบ ซึ่งการคิดจะใช้โทเค็นหลายร้อยโทเค็นแม้จะเป็นคำถามง่ายๆ สำหรับ ZCode หมายความว่าสองสิ่งนี้: อย่าลดขีดจำกัดความยาวคำตอบของโมเดล (อย่างน้อย 600 โทเค็นแม้จะเป็นคำตอบสั้นๆ) และสำหรับการแก้ไขด่วนให้ปรับ Thought Level ลดลง ในระดับ API คือ reasoning_effort: low ดูการวิเคราะห์โมเดลและขีดจำกัดโดยละเอียดได้ในบทความ GLM-5.3 Flash ในเครือข่าย Gonka.

คำถามที่พบบ่อย:

  • ทำไมโมเดลใหม่ถึงเจอ 429 หรือคิว? — ขณะนี้โมเดลถูกให้บริการโดยโฮสต์เพียงบางส่วนในเครือข่าย ในช่วงเวลาที่มีการใช้งานหนาแน่น คำขออาจต้องรอคิวว่าง ให้ลองส่งคำขออีกครั้งในอีกไม่กี่วินาที ตัวโหลดบาลานซ์จะหาโหนดที่พร้อมใช้งานให้ สถานะปัจจุบันตรวจสอบได้ที่ หน้าสถานะเกตเวย์
  • มีอะไรให้ใช้งานอีกบ้าง? — นอกจาก GLM-5.3 Flash แล้ว ยังมี MiniMax M2.7 และ DeepSeek V4 Flash: ทั้งสามโมเดลทำงานใน ZCode ผ่าน custom provider ตัวเดียวกัน การตั้งค่าจากคู่มือนี้สามารถใช้งานได้จริงทั้งหมด
  • เรื่องความเป็นส่วนตัวเป็นอย่างไร? — เกตเวย์ไม่ได้จัดเก็บเนื้อหาของพร้อมท์และคำตอบ ในสถิติจะมีเพียงข้อมูลสรุปการใช้งานเท่านั้น
  • Coding Plan คุ้มค่ากว่าเมื่อไหร่? — หากคุณทำงานคนเดียว อยู่ภายใต้โควตา Lite และไม่รันเอเจนต์แบบขนาน การสมัครสมาชิกแบบจ่ายคงที่นั้นสะดวกและคาดการณ์ได้ง่าย ให้คำนวณตามรูปแบบการใช้งานของคุณ: หากใช้งานเอเจนต์อย่างหนัก การจ่ายตามการใช้โทเค็นผ่านเครือข่ายจะประหยัดกว่าหลายเท่าตัว แต่ถ้าแก้ไขโค้ดเพียงเล็กน้อยวันละไม่กี่ครั้ง ความแตกต่างอาจไม่ชัดเจน
  • สามารถใช้กับเครื่องมืออื่นได้หรือไม่? — ได้: endpoint เดียวกันนี้ใช้งานได้ใน Claude Code, Cursor, Cline และไคลเอนต์ใดๆ ที่รองรับมาตรฐาน OpenAI/Anthropic
ZCode 3.0 เป็น IDE สำหรับเอเจนต์ที่น่าสนใจ แต่การสมัครสมาชิก GLM Coding Plan แบบดั้งเดิมนั้นอิงตามโควตา: "พร้อมท์" ในหน้าต่าง 5 ชั่วโมง, ตัวคูณ ×3 ในช่วงเวลาที่มีการใช้งานสูง และจำกัดการรันคำขอขนานเพียงหนึ่งรายการในแพ็กเกจระดับเริ่มต้น ยิ่งโหลดงานที่เป็นเอเจนต์มากเท่าไหร่ ก็ยิ่งมีค่าใช้จ่ายสูงและคาดเดายากขึ้นเท่านั้น บริการ BYOK อย่างเป็นทางการช่วยแก้ปัญหานี้ได้: เชื่อมต่อ JoinGonka Gateway ในฐานะ custom provider และจ่ายค่าโทเค็นตามการใช้งานจริงในราคาของเครือข่ายแบบกระจายศูนย์อย่าง Gonka ซึ่งถูกกว่า API ส่วนกลางหลายร้อยเท่า GLM-5.3 Flash ซึ่งเป็น reasoning-model แบบเปิดจาก Z.ai เปิดให้บริการแล้วในเครือข่าย พร้อมกับ MiniMax M2.7 และ DeepSeek V4 Flash เริ่มต้นได้ง่ายๆ ด้วยโทเค็นฟรีสำหรับผู้ใช้งานใหม่

ต้องการเรียนรู้เพิ่มเติมหรือไม่?

สำรวจส่วนอื่นๆ หรือเริ่มรับ GNK ทันที

รับโทเค็นฟรี →