ส่วนของฐานความรู้ ▾

การนำทาง

▸ เริ่มต้นที่นี่ ตามบทบาท

หมวดหมู่

เครื่องมือ 36
อภิธานศัพท์ 12

เครื่องมือ

ZCode: GLM-inferenced ราคาประหยัดแทนที่ GLM Coding Plan

ในเดือนมิถุนายน 2026 Z.ai ได้เปิดตัว ZCode 3.0 ซึ่งเป็นสภาพแวดล้อมการพัฒนาแบบ Agent-based บนเดสก์ท็อป ที่ทางบริษัทเรียกว่า «Official Harness for GLM-5.2» ผลิตภัณฑ์ได้รับความสนใจอย่างรวดเร็วด้วย: เอ็นจิ้น Agent ในตัว, งานอิสระผ่าน /goal, โหมด multi-agent และการจัดการเซสชันระยะไกลผ่าน Telegram แต่เมื่อมีรีวิวออกมา ก็มีคำถามจากผู้ใช้ GLM Coding Plan รุ่นแรกๆ: โควตาถูกนับเป็น «prompts» ในรอบ 5 ชั่วโมง, ในชั่วโมงเร่งด่วนจะถูกหัก 3 เท่า, แผนเริ่มต้นรองรับการขอข้อมูลแบบขนานแค่หนึ่งรายการ และบน Hacker News มีการบ่นเกี่ยวกับการถูกบล็อกหลังจากทำงานหนัก

ข่าวดีคือ ZCode รองรับ custom provider อย่างเป็นทางการ คุณสามารถเชื่อมต่อ API ที่เข้ากันได้กับ OpenAI หรือ Anthropic และจ่ายเงินตามการใช้งานจริง (tokens) แทนที่จะจ่ายตามโควตาสมาชิก ในคู่มือนี้เราจะมาเจาะลึกว่า ZCode คืออะไร และ GLM Coding Plan ทำงานอย่างไร จากนั้นจะตั้งค่า ZCode ให้เชื่อมต่อกับ JoinGonka Gateway ซึ่งเป็นเกตเวย์ของเครือข่ายกระจายอำนาจ Gonka ที่เพิ่ม GLM-5.2 เข้ามาในรีจิสทรีแล้ว สรุปคือ: เครื่องมือเดิม, โมเดล open-weight เดิม แต่ประหยัดกว่าการใช้ API แบบรวมศูนย์หลายร้อยเท่า

ZCode คืออะไร: สภาพแวดล้อมการพัฒนารูปแบบ Agent จาก Z.ai

ZCode ไม่ใช่แค่ «ตัวแก้ไขโค้ดที่มีแชทข้างๆ» แต่เป็น ADE: คุณระบุเป้าหมาย เอเจนต์จะวางแผน แก้ไขไฟล์ เรียกใช้การทดสอบ และวนซ้ำจนกว่าจะได้ผลลัพธ์ ทำงานเป็นแอปพลิเคชันเดสก์ท็อปบน macOS และ Windows (เวอร์ชัน Linux อยู่ในสถานะเบต้า)

ความสามารถหลักของเวอร์ชัน 3.0:

  • ZCode Agent — เอ็นจิ้นเอเจนต์ของตนเองที่รวมเข้ากับ GLM-5.2 อย่างลึกซึ้ง นอกจากนี้ยังรองรับเอเจนต์ภายนอกอื่นๆ (Claude Code, Codex, Gemini CLI และอื่นๆ)
  • Goal-mode (/goal) — งานอิสระระยะยาว: แผน → ดำเนินการ → ตรวจสอบเป็นขั้นตอน
  • Multi-agent — การทำงานแบบขนานของเอเจนต์หลายตัวในโปรเจกต์เดียวกัน
  • การจัดการระยะไกล — เริ่มต้นและควบคุมเซสชันจาก Telegram, WeChat และ Feishu: เอเจนต์ทำงานบนเครื่องของคุณ แต่คุณตอบคำถามได้จากมือถือ

ไคลเอนต์นั้นฟรี โดย Z.ai มอบโควตาโทเค็น GLM-5.2 ให้ผู้ใช้ใหม่ทุกวันเพื่อทดลองใช้งาน หลังจากนั้นคุณต้องเลือกสมัคร GLM Coding Plan หรือใช้ API-key ของตนเอง และนี่คือจุดที่ต้องทำความเข้าใจ เพราะกลไกการรับสมาชิกเป็นส่วนที่ถูกพูดถึงมากที่สุดของผลิตภัณฑ์

GLM Coding Plan: ราคา ขีดจำกัด และโควตา

GLM Coding Plan คือสมาชิกแบบ Z.ai ที่ให้สิทธิ์เข้าถึงโมเดล GLM ใน ZCode และเครื่องมืออื่นๆ อีกกว่ายี่สิบรายการ ณ เวลาที่เผยแพร่ (กรกฎาคม 2026) โครงสร้างพื้นฐานมีดังนี้ (ราคาและโปรโมชั่นเปลี่ยนแปลงได้ โปรดตรวจสอบที่ z.ai/subscribe):

แพ็กเกจราคา $/เดือนโควตาการขอข้อมูลแบบขนาน
Lite$18 (โปรโมชั่นเริ่มต้น ~$12.6)«Prompts» ใน 5 ชั่วโมง + ขีดจำกัดรายสัปดาห์1
Pro$72×4 จาก Lite1
Max$160×16 จาก Liteสูงสุด 30

สิ่งที่ผู้ใช้บ่นกัน (จากกระทู้ Hacker News และ GitHub):

  • ตัวคูณช่วงพีค ช่วงเวลาเร่งด่วน (14:00—18:00 UTC+8 — ช่วงเย็นในเอเชีย, ช่วงเช้า-บ่ายในยุโรป) ทุกคำขอจะหักโควตาด้วยตัวคูณ ×3, นอกช่วงเวลาหัก ×2 ต้องวางแผนการใช้งานตามโซนเวลาของปักกิ่ง
  • โควตาคิดเป็น «prompts» ไม่ใช่โทเค็น จำนวนโทเค็นที่เหลืออยู่ไม่มีความโปร่งใส ในกระทู้มีเรื่องราวทำนองว่า «ใช้งาน ~17M tokens บน GLM แล้วถูกบล็อกเป็นเวลาสี่วัน»
  • หนึ่งคำขอแบบขนาน สำหรับ Lite และ Pro สำหรับสภาพแวดล้อมแบบเอเจนต์ ถือว่ามีผลกระทบ: โหมด multi-agent ของ ZCode เองและย่อยๆ เอเจนต์จะเจอกับคิวรอ
  • GLM-5.2 ใช้โควตาเร็วกว่า โมเดลขนาดเล็ก — ตัวท็อปจะกินโควตาด้วยตัวคูณของตัวเอง

สรุปง่ายๆ: สำหรับการพัฒนาคนเดียวทั่วไป สมาชิกทำงานได้ตามปกติ แต่ยิ่งโหมดการทำงานของคุณเป็น «เอเจนต์» มากเท่าไหร่ — งานขนาน, เซสชันอิสระยาวๆ, การประมวลผลช่วงกลางคืน — โมเดลโควตาก็จะยิ่งเหมือนการลุ้นหวย ทางเลือกคือการจ่ายตามการใช้งานจริง (tokens): ไม่มียอดรวมรอบ, ไม่มีการคูณ, ไม่มีคิว — ใช้ไปเท่าไหร่จ่ายเท่านั้น นี่คือโมเดลที่กลไก custom provider ในตัว ZCode มอบให้ และตั้งค่าได้ใน 5 นาที

BYOK ใน ZCode: API-key ของคุณเองและ custom provider

ZCode รองรับ BYOK อย่างเป็นทางการ: เอกสารระบุชัดเจนว่าสามารถเพิ่ม "บริการใดๆ ที่เข้ากันได้กับโปรโตคอลของ OpenAI หรือ Anthropic" เช่น public API, ช่องทางองค์กร หรือแม้แต่การติดตั้งแบบ self-hosted โดยสามารถตั้งค่าได้ 3 วิธี:

  • ปุ่ม Connect บนหน้าจอ welcome → «Set Your API Key»;
  • Manage Models ในตัวเลือกโมเดล;
  • ไอคอนฟันเฟือง → Settings → Model Settings → Add Provider.

คุณต้องระบุ OpenAI Base URL และ/หรือ Anthropic Base URL พร้อมกับ API Key จากนั้น ZCode จะดึงรายชื่อโมเดลที่มีให้โดยอัตโนมัติ

ข้อผิดพลาดที่พบบ่อย 3 ประการ:

  • Endpoint ของ Z.ai มีความแตกต่างกัน แผนการสมัครสมาชิก Coding Plan ทำงานผ่าน coding-endpoint: https://api.z.ai/api/coding/paas/v4 เท่านั้น; หากใช้ /api/paas/v4 ทั่วไปกับคีย์สมาชิกจะเกิดข้อผิดพลาด — นี่คือสาเหตุคลาสสิกของ "ฉันได้รับ 401/429 ทั้งที่จ่ายเงินแล้ว"
  • "ทำงานใน Claude Code ≠ ทำงานใน ZCode" ZCode จะไม่อ่าน Environment Variables เช่น ANTHROPIC_BASE_URL ที่ใช้ใน Claude Code: ZCode มีระบบเก็บการตั้งค่าของตัวเอง โปรดตั้งค่าผ่าน Settings เท่านั้น
  • "โมเดลปรากฏในรายการ ≠ คีย์นั้นมีโควตาอยู่" รายชื่อโมเดลจะถูกดึงมาจาก API ของผู้ให้บริการ แต่ความพร้อมใช้งานขึ้นอยู่กับยอดเงินคงเหลือและขีดจำกัดของคีย์นั้นๆ

ต่อไปคือวิธีใช้จริง: เชื่อมต่อ ZCode เข้ากับชัตเวย์ JoinGonka เพื่อรับ GLM-stack โดยจ่ายตามการใช้งานจริง (tokens)

การตั้งค่า JoinGonka Gateway ใน ZCode: GLM โดยจ่ายตามโทเค็น

JoinGonka Gateway คือประตูสู่เครือข่าย Gonka แบบกระจายศูนย์ด้วย 2 โปรโตคอล: OpenAI-compatible /v1/chat/completions และ Anthropic Messages /v1/messages โดยใช้โมเดลเศรษฐกิจแบบ pay-per-token: ไม่มีข้อจำกัด 5 ชั่วโมง ไม่มีตัวคูณช่วงพีค ×3 และไม่มีข้อจำกัดคำขอพร้อมกัน; คุณสามารถดูการใช้งานจริงได้ใน Dashboard และ Gateway ไม่มีการจัดเก็บเนื้อหาคำสั่ง (prompt) ของคุณ

ขั้นตอน (สำหรับอินเทอร์เฟซ Custom Provider ปัจจุบัน):

ขั้นตอนการดำเนินการ
1. คีย์ลงทะเบียน — gate.joingonka.ai/register (บัญชีใหม่รับฟรี 10M tokens) สร้าง API-key ในส่วน Keys ดูรายละเอียดได้ที่ API Quick Start
2. ProviderZCode → Settings → Model Settings → Add Provider ชื่อ: JoinGonka
3. Base URLhttps://gate.joingonka.ai/v1
4. API Keyคีย์ของคุณรูปแบบ jg-…
5. API formatChat completions (/chat/completions)
6. โมเดลAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000 สามารถเพิ่ม moonshotai/Kimi-K2.6 และ MiniMaxAI/MiniMax-M2.7 ได้เช่นกัน รายการปัจจุบันตรวจสอบได้ที่ GET /v1/models

สำหรับ ZCode เวอร์ชันเก่า จะมีสองช่องแยกกัน: OpenAI Base URL (https://gate.joingonka.ai/v1) และ Anthropic Base URL (https://gate.joingonka.ai — ตัวเครื่องมือจะเพิ่ม path ให้เอง)

การตรวจสอบ: เลือกโมเดลที่สร้างขึ้นและลองถามคำถาม หากได้รับคำตอบแสดงว่าทำงานได้ปกติ; หากเจอข้อผิดพลาด 401 ให้ตรวจสอบคีย์, 402 ให้ตรวจสอบยอดเงินในบัญชี หากใช้ DeepSeek V4 Flash แล้วเจอ "Model request failed" ในขณะตั้ง Thought Level เป็น Max ให้เปลี่ยนเป็น High แล้วลองอีกครั้ง

คำแนะนำ: คำสั่ง npx @joingonka/setup --tool zcode จะแสดงค่าที่จำเป็นสำหรับช่องด้านล่าง และตรวจสอบว่า Gateway ยอมรับคีย์หรือไม่ ZCode ต้องตั้งค่าผ่าน UI เท่านั้น ไม่มีไฟล์คอนฟิกที่แก้ไขได้โดยตรง

การเปรียบเทียบราคา: Coding Plan, Z.ai API, OpenRouter และ Gonka

ค่าใช้จ่ายในการทำ GLM-inferenced ผ่านช่องทางต่างๆ (ราคาต่อ 1M token; ของคู่แข่งอ้างอิงข้อมูล ณ กรกฎาคม 2026 ส่วนราคาของ JoinGonka จะดึงมาจาก API Gateway โดยตรง):

ช่องทางขาเข้า, $/1Mขาออก, $/1Mรูปแบบการชำระเงิน
Z.ai API (GLM-5.2)$1.40 (อินพุตแบบแคช — $0.26)$4.40ตามจำนวน token
GLM Coding Plan$18—160/เดือนสมัครสมาชิก: โควตา "prompt", ตัวคูณ ×3 ในช่วงพีค, จำกัดการทำงานขนาน
OpenRouter (z-ai/glm-5.2)$0.93$3.00ตามจำนวน token; ไม่มีตัวเลือก GLM-5.2 แบบฟรี
JoinGonka Gateway$0.0032$0.0097ตามจำนวน token, เครือข่าย Gonka

ความแตกต่างระดับสองถึงสามเท่าไม่ได้มาจากการปัดเศษเพื่อการตลาด แต่มาจากระบบเศรษฐกิจที่ต่างออกไป: การคำนวณจะถูกทำโดยผู้เข้าร่วมในเครือข่ายแบบกระจายศูนย์ ซึ่งสร้างรายได้จากตัวงานโดยตรง ไม่ใช่จากส่วนต่างกำไรของศูนย์ข้อมูล สำหรับบทวิเคราะห์เชิงลึกเกี่ยวกับวิธีการทำงานและขอบเขตการใช้งาน สามารถอ่านได้ในบทความ เรื่อง AI API ที่ถูกที่สุด

คำเตือนเกี่ยวกับ GLM-5.2: ราคาจริงของโมเดลจะถูกกำหนดโดยเครือข่าย ณ เวลาที่เปิดใช้งาน (ในตารางข้างต้นคือราคาปัจจุบันของโมเดลในเครือข่าย) ตัวเลขบนหน้านี้จะอัปเดตอัตโนมัติ ไม่ต้องคำนวณใหม่เองด้วยมือ

GLM-5.2 ในเครือข่าย Gonka: สถานะและคำถามที่พบบ่อย

โมเดล zai-org/GLM-5.2-FP8 ได้ถูกเพิ่มลงใน on-chain registry ของเครือข่าย Gonka เรียบร้อยแล้ว: การตั้งค่ารองรับ context window สูงถึง 400K โทเค็น และตัวโมเดลเองถือเป็นโมเดลขนาดใหญ่ (ต้องใช้ VRAM มากกว่าหนึ่งเทราไบต์ต่อหนึ่ง replica) ขณะนี้อยู่ในระหว่างการเริ่มใช้งาน: โหนดของเครือข่ายกำลัง warm-up ค่า weight เมื่อการตรวจสอบเสร็จสมบูรณ์ โมเดลจะปรากฏในรายการโมเดลของ Gateway โดยอัตโนมัติ — base URL และคีย์ยังคงเหมือนเดิม ใน ZCode คุณเพียงแค่เลือกโมเดลจากตัวเลือกเท่านั้น

เกี่ยวกับตัวโมเดล: เป็น open-weight ภายใต้ใบอนุญาต MIT, สถาปัตยกรรม MoE ที่มีพารามิเตอร์ ~750B (ใช้งานจริงประมาณ 40B ต่อโทเค็น), รองรับ context window สูงถึง 1M โทเค็น ข้อมูลจาก Z.ai ระบุว่าบน SWE-bench Pro โมเดลทำคะแนนได้ 62.1 ซึ่งสูงกว่า GPT-5.5 และบน FrontierSWE ตามหลัง Claude Opus 4.8 เพียงประมาณหนึ่งเปอร์เซ็นต์ สำหรับ open-weight model นี่ถือเป็นอันดับต้นๆ ในด้านการเขียนโค้ด

คำถามที่พบบ่อย:

  • ทำไมหลังจากเปิดโมเดลใหม่ถึงเจอ error 429? — นี่เป็นช่วงการเริ่มใช้งาน: บางโหนดกำลังโหลด weight อยู่ โปรดลองส่งคำขออีกครั้งหลังจากผ่านไปไม่กี่วินาที Load balancer จะหาโหนดที่พร้อมใช้งานให้คุณ
  • วันนี้มีอะไรให้ใช้งานได้บ้าง? — Kimi K2.6, MiniMax M2.7 และ DeepSeek V4 Flash: ทั้งสามโมเดลทำงานใน ZCode ผ่าน custom provider ตัวเดิม การตั้งค่าในคู่มือนี้ใช้งานได้จริงทันที
  • ความเป็นส่วนตัวเป็นอย่างไร? — Gateway ไม่เก็บเนื้อหาของ prompts และ responses ในสถิติจะมีเพียงข้อมูลสรุปการใช้งานเท่านั้น
  • เมื่อไหร่ที่ Coding Plan ถึงจะคุ้มกว่า? — หากคุณทำงานคนเดียว อยู่ในโควตา Lite และไม่ได้รันเอเจนต์แบบขนาน การสมัครสมาชิกแบบจ่ายคงที่ก็สะดวกและคาดการณ์ได้ง่าย ให้คำนวณตามลักษณะการใช้งานของคุณ: หากทำงานด้านเอเจนต์อย่างหนัก การจ่ายตามการใช้จริงผ่านเครือข่ายจะถูกกว่ามาก แต่ถ้าแค่แก้ไขโค้ดเล็กน้อยวันละสองสามครั้ง ความแตกต่างอาจไม่ชัดเจนนัก
  • รองรับเครื่องมืออื่นๆ หรือไม่? — ใช่: endpoint เดียวกันนี้ทำงานได้ใน Claude Code, Cursor, Cline และ client อื่นๆ ที่รองรับ OpenAI/Anthropic
ZCode 3.0 เป็น IDE ที่เน้นเอเจนต์ที่น่าจับตามอง แต่การสมัครสมาชิก GLM Coding Plan แบบดั้งเดิมนั้นถูกจำกัดด้วยโควตา: "prompts" ในช่วง 5 ชั่วโมง, ตัวคูณ ×3 ในชั่วโมงเร่งด่วน และคำขอแบบขนานหนึ่งรายการในระดับแพ็คเกจเริ่มต้น ยิ่งภาระงานเป็นแบบเอเจนต์มากเท่าไหร่ ค่าใช้จ่ายก็ยิ่งสูงขึ้นและคาดเดาไม่ได้มากขึ้นเท่านั้น BYOK อย่างเป็นทางการช่วยแก้ปัญหานี้ได้: เชื่อมต่อ JoinGonka Gateway ในฐานะ custom provider และจ่ายตามโทเค็นจริงในราคาของเครือข่ายแบบกระจายศูนย์ Gonka ซึ่งต่ำกว่า API แบบรวมศูนย์หลายร้อยเท่า GLM-5.2 อยู่ในรีจิสทรีของเครือข่ายแล้วและจะปรากฏในตัวเลือกโมเดลของคุณโดยอัตโนมัติ ในขณะที่ Kimi K2.6, MiniMax M2.7 และ DeepSeek V4 Flash สามารถใช้งานได้แล้ววันนี้ เริ่มต้นด้วย 10M โทเค็นฟรี

ต้องการเรียนรู้เพิ่มเติมหรือไม่?

สำรวจส่วนอื่นๆ หรือเริ่มรับ GNK ทันที

รับโทเค็นฟรี 10M →