জ্ঞানকোষের বিভাগসমূহ ▾

নেভিগেশন

▸ এখানে শুরু করুন রোল অনুযায়ী

বিভাগ

সরঞ্জাম 52
গ্লসারি 12

Tools

ZCode: GLM Coding Plan এর পরিবর্তে সাশ্রয়ী GLM-inferenced

জুন ২০২৬-এ Z.ai ZCode 3.0 রিলিজ করেছে—একটি ডেস্কটপ এজেন্টিক ডেভেলপমেন্ট এনভায়রনমেন্ট, যাকে কোম্পানি নিজেই "Official Harness for GLM-5.2" বলে ডাকে। পণ্যটি দ্রুত নজর কেড়েছে: নিজস্ব এজেন্টিক কোর, /goal-এর মাধ্যমে স্বায়ত্তশাসিত টাস্ক, মাল্টি-এজেন্ট মোড এবং সরাসরি Telegram থেকে রিমোট সেশন ম্যানেজমেন্ট। কিন্তু পর্যালোচনার ঢেউয়ের সাথে GLM Coding Plan-এর প্রথম গ্রাহকদের কাছ থেকে প্রশ্নের ঢেউও এসেছে: কোটা "প্রম্পট" হিসেবে গণ্য করা হয় পাঁচ ঘণ্টার উইন্ডোতে, পিক আওয়ারে খরচ তিন গুণ হয়, ছোট প্ল্যানগুলোতে একটি মাত্র সমান্তরাল অনুরোধ থাকে এবং Hacker News-এ কাজের ব্যস্ত দিনের পর হঠাৎ ব্লক হয়ে যাওয়ার অভিযোগ পাওয়া যাচ্ছে।

সুসংবাদ: ZCode আনুষ্ঠানিকভাবে custom provider সাপোর্ট করে—এর সাথে যেকোনো OpenAI বা Anthropic-সামঞ্জস্যপূর্ণ API সংযুক্ত করা যায় এবং সাবস্ক্রিপশন কোটার পরিবর্তে প্রকৃত টোকেনের জন্য অর্থ প্রদান করা যায়। এই গাইডে আমরা ZCode কী এবং GLM Coding Plan কীভাবে কাজ করে তা বিশ্লেষণ করব, এবং তারপর ধাপে ধাপে JoinGonka Gateway-তে ZCode সেটআপ করব—যা Gonka বিকেন্দ্রীভূত নেটওয়ার্কের গেটওয়ে, যা Z.ai-এর নিজস্ব ওপেন রিজনিং মডেল GLM-5.3 Flash প্রদান করে। ফলাফল: একই টুল, একই open-weight মডেল, কিন্তু অর্থনীতি হবে টোকেন ভিত্তিক এবং সেন্ট্রালাইজড API-এর তুলনায় কয়েক গুণ সস্তা।

ZCode কী: Z.ai এর এজেন্টিক ডেভেলপমেন্ট এনভায়রনমেন্ট

ZCode কোনো "চ্যাট-সাইডবার যুক্ত এডিটর" নয়, বরং একটি ADE: আপনি গোল সেট করেন, এজেন্ট প্ল্যান তৈরি করে, ফাইল সংশোধন করে, পরীক্ষা চালায় এবং ফলাফল না পাওয়া পর্যন্ত কাজ চালিয়ে যায়। এটি macOS এবং Windows এ ডেস্কটপ অ্যাপ হিসেবে কাজ করে (Linux বিল্ড বিটা পর্যায়ে আছে)।

ভার্সন ৩.০ এর মূল সক্ষমতা:

  • ZCode Agent — GLM-5.2 এর গভীর ইন্টিগ্রেশনসহ নিজস্ব এজেন্টিক কোর; পাশাপাশি থার্ড-পার্টি এজেন্টও কানেক্ট করা যায় (Claude Code, Codex, Gemini CLI ইত্যাদি);
  • Goal-মোড (/goal) — দীর্ঘ অটোনমাস টাস্ক: প্ল্যান → এক্সিকিউশন → ধাপে ধাপে ভেরিফিকেশন;
  • Multi-agent — একটি প্রজেক্টে একাধিক এজেন্টের প্যারালাল কাজ;
  • রিমোট ম্যানেজমেন্ট — Telegram, WeChat এবং Feishu থেকে সেশন রান ও কন্ট্রোল করা: এজেন্ট আপনার মেশিনে কাজ করবে, আর আপনি ফোন থেকেই সেই প্রশ্নের উত্তর দেবেন।

ক্লায়েন্ট নিজেই ফ্রি, নতুন ইউজারদের Z.ai শুরুতে GLM-5.2 এক্সপ্লোর করার জন্য ডেইলি টোকেন কোটা দেয়। এরপর হয় আপনাকে GLM Coding Plan সাবস্ক্রাইব করতে হবে, অথবা নিজস্ব API-key ব্যবহার করতে হবে। আর এখানেই ডিটেলসগুলো বোঝা জরুরি, কারণ সাবস্ক্রিপশন মডেলটিই প্রোডাক্টটির সবচেয়ে আলোচিত বিষয়।

GLM Coding Plan: প্রাইস, লিমিট এবং কোটা

GLM Coding Plan — Z.ai-এর সাবস্ক্রিপশন, যা ZCode এবং বিশের বেশি তৃতীয় পক্ষের টুলে GLM মডেলে প্রবেশাধিকার দেয়। প্রকাশের সময়ে (জুলাই 2026) বেস টেবিলটা এরকম — তবে দাম ও অফার বদলায়, z.ai/subscribe-এর লাইভ পেজে দেখে নিন:

প্ল্যানদাম, $/মাসকোটাসমান্তরাল অনুরোধ
Lite$18 (অফারে — প্রায় $12.6 থেকে)৫-ঘণ্টার উইন্ডোতে «prompt» + সাপ্তাহিক সিলিং1
Pro$72Lite-এর ×41
Max$160Lite-এর ×1630 পর্যন্ত

সাবস্ক্রাইবাররা যা নিয়ে অভিযোগ করেন (Hacker News ও GitHub থ্রেড):

  • পিক-আওয়ার মাল্টিপ্লায়ার। পিক আওয়ারে (14:00—18:00 UTC+8 — এশিয়ায় সন্ধ্যা, ইউরোপে সকাল-দুপুর) প্রতিটি অনুরোধ ×3 গুণকে কোটা কাটে, পিকের বাইরে ×2। খরচ পরিকল্পনা করতে হয় বেইজিং টাইমজোন ধরে।
  • কোটা «prompt»-এ, টোকেনে নয়। আসলে কত টোকেন বাকি আছে — অস্পষ্ট; থ্রেডে এমন গল্প আছে «GLM-এ ~17M টোকেন ব্যবহার করেছি — আর চার দিনের ব্লক পেয়েছি»।
  • Lite ও Pro-তে একটি সমান্তরাল অনুরোধ। এজেন্ট পরিবেশে এটি টের পাওয়া যায়: ZCode-এর multi-agent মোড এবং যেকোনো সমান্তরাল সাব-এজেন্ট লাইনে আটকে যায়।
  • GLM-5.2 কোটা ছোট মডেলের চেয়ে দ্রুত শেষ করে — ফ্ল্যাগশিপ নিজের মাল্টিপ্লায়ারে সীমা পুড়িয়ে দেয়।

উপসংহার সহজ: শান্ত একক ডেভেলপমেন্টের জন্য সাবস্ক্রিপশন সৎভাবে কাজ করে। কিন্তু আপনার মোড যত বেশি «এজেন্টমুখী» — সমান্তরাল কাজ, দীর্ঘ স্বায়ত্তশাসিত সেশন, রাতের রান — ততবার কোটার মডেল লটারিতে পরিণত হয়। বিকল্প — প্রকৃত টোকেনের ভিত্তিতে পেমেন্ট: উইন্ডো, মাল্টিপ্লায়ার ও লাইনের ঝামেলা নেই — এজেন্ট যত খরচ করেছে, ততই কাটা হবে। ZCode-এ বিল্ট-ইন custom provider এই মডেলটিই দেয়, আর সেটআপ পাঁচ মিনিটের কাজ।

ZCode এ BYOK: নিজস্ব API-key এবং custom provider

ZCode-এ অফিসিয়ালিভাবে BYOK সমর্থন বিল্ট-ইন: ডকুমেন্টেশন সরাসরি অনুমতি দেয় «OpenAI বা Anthropic প্রোটোকলের সাথে সামঞ্জস্যপূর্ণ যেকোনো সার্ভিস» যোগ করার — পাবলিক API, কর্পোরেট চ্যানেল এমনকি self-hosted ইনস্টলেশনও। তিনটি উপায়ে কনফিগার করা যায়:

  • welcome স্ক্রিনে Connect বাটন → «Set Your API Key»;
  • মডেল সিলেক্টরে Manage Models;
  • গিয়ার আইকন → Settings → Model Settings → Add Provider।

প্রোভাইডারকে OpenAI Base URL এবং/অথবা Anthropic Base URL প্লাস API Key দিতে হয় — ZCode নিজেই উপলব্ধ মডেলের তালিকা টেনে নেবে।

সবচেয়ে বেশি যে তিনটি জায়গায় মানুষ হোঁচট খায়:

  • Z.ai-এর Endpoint'গুলো আলাদা। Coding Plan সাবস্ক্রিপশন কেবল coding-endpoint https://api.z.ai/api/coding/paas/v4 দিয়ে কাজ করে; সাবস্ক্রিপশন কী দিয়ে সাধারণ /api/paas/v4 এরর দেবে — «প্ল্যান পেমেন্ট করেছি অথচ 401/429 আসছে»-এর ক্লাসিক কারণ।
  • «Claude Code-এ কাজ করে ≠ ZCode-এ কাজ করে।» ANTHROPIC_BASE_URL-এর মতো এনভায়রনমেন্ট ভেরিয়েবল, যা দিয়ে Claude Code কনফিগার করা হয়, ZCode সেগুলো পড়ে না: এর প্রোভাইডার সেটিংসের নিজস্ব স্টোরেজ আছে। কেবল Settings দিয়েই কনফিগার করুন।
  • «সিলেক্টরে মডেল দেখা যায় ≠ কী-তে কোটা আছে।» মডেলের তালিকা প্রোভাইডারের API থেকে আসে, আর অ্যাক্সেস নির্ভর করে নির্দিষ্ট কী-এর ব্যালান্স ও লিমিটের উপর।

এরপর ব্যবহারিক দিক: ZCode-এ JoinGonka গেটওয়ে সংযুক্ত করছি এবং টোকেনের বিনিময়ে GLM স্ট্যাক পাচ্ছি।

ZCode-এ JoinGonka Gateway কনফিগারেশন: টোকেনের বিনিময়ে GLM

JoinGonka Gateway — Gonka বিকেন্দ্রীকৃত নেটওয়ার্কের একটি গেটওয়ে, যা দুটি নেটিভ প্রোটোকল সাপোর্ট করে: OpenAI-সামঞ্জস্যপূর্ণ /v1/chat/completions এবং Anthropic Messages /v1/messages। ইকোনমি হলো pay-per-token: এখানে কোনো ৫-ঘণ্টার উইন্ডো, ×3 পিক মাল্টিপ্লায়ার বা একটি সমান্তরাল রিকোয়েস্টের সীমাবদ্ধতা নেই; খরচের হিসাব ড্যাশবোর্ডে রিয়েল-টাইমে দেখা যায় এবং গেটওয়ে প্রম্পটের কন্টেন্ট সংরক্ষণ করে না।

ধাপে ধাপে (বর্তমান Custom Provider ইন্টারফেস):

ধাপঅ্যাকশন
১. কীরেজিস্ট্রেশন করুন — gate.joingonka.ai/register (নতুন অ্যাকাউন্টের জন্য 3M ফ্রি টোকেন), Keys সেকশনে API-কী তৈরি করুন। বিস্তারিত — API Quick Start-এ।
২. প্রোভাইডারZCode → Settings → Model Settings → Add Provider। নাম: JoinGonka
৩. Base URLhttps://gate.joingonka.ai/v1
৪. API Keyআপনার jg-… ফরম্যাটের কী
৫. API formatChat completions (/chat/completions)
৬. মডেলAdd Model → Model ID deepseek-ai/DeepSeek-V4-Flash-0731, Context window 380000। একইভাবে MiniMaxAI/MiniMax-M2.7 এবং zai-org/GLM-5.3-Flash যোগ করুন — Z.ai-এর নিজস্ব রিজনিং মডেল; বর্তমান তালিকা এবং লিমিট — GET /v1/models।

ZCode-এর পুরোনো ভার্সনে এর পরিবর্তে দুটি আলাদা ফিল্ড রয়েছে: OpenAI Base URL (https://gate.joingonka.ai/v1) এবং Anthropic Base URL (https://gate.joingonka.ai — ক্লায়েন্ট নিজেই পাথ যোগ করে নেবে)।

চেক: তৈরি করা মডেলটি নির্বাচন করুন এবং এজেন্টকে যেকোনো প্রশ্ন করুন। উত্তর আসলে সবকিছু ঠিকঠাক; 401 এরর হলে কী চেক করুন, 402 হলে অ্যাকাউন্টের ব্যালেন্স চেক করুন। যদি DeepSeek V4 Flash-এ Thought Level Max হওয়ার সময় «Model request failed» দেখায়, তবে Thought Level High-এ পরিবর্তন করুন এবং রিকোয়েস্টটি পুনরায় দিন।

টিপস। npx @joingonka/setup --tool zcode কমান্ডটি এই ফিল্ডগুলোর জন্য প্রস্তুত ভ্যালুগুলো প্রিন্ট করবে — বেস URL, কী, মডেল আইডি এবং এর আসল লিমিট: কনটেক্সট উইন্ডো এবং রেসপন্স লিমিট — এবং একটি লাইভ রিকোয়েস্টের মাধ্যমে যাচাই করবে যে গেটওয়ে এগুলো গ্রহণ করছে কি না। ZCode শুধুমাত্র UI এর মাধ্যমে কনফিগার করা যায় — এর কোনো ফাইল নেই যা নিরাপদে এডিট করা যায়, তাই ভ্যালুগুলো ম্যানুয়ালি ইনপুট করতে হবে।

মূল্য তুলনা: Coding Plan, Z.ai API, OpenRouter এবং Gonka

বিভিন্ন চ্যানেলে GLM-ইনফারেন্সের খরচ (প্রতি 1M টোকেনের মূল্য; প্রতিযোগীদের মূল্য সেপ্টেম্বর ২০২৬ অনুযায়ী নির্ধারিত, JoinGonka-এর দাম গেটওয়ে API থেকে সরাসরি পেজে দেখানো হয়):

চ্যানেলইনপুট, $/1Mআউটপুট, $/1Mপেমেন্ট মডেল
Z.ai API (GLM-5.2)$1.40 (ক্যাশড ইনপুট — $0.26)$4.40টোকেন অনুযায়ী
GLM Coding Plan$18—160/মাসসাবস্ক্রিপশন: "প্রম্পট" কোটা, পিক আওয়ারে ৩ গুণ মাল্টিপ্লায়ার, সমান্তরাল সীমানা
OpenRouter (z-ai/glm-5.2)$1.40$4.40টোকেন অনুযায়ী
OpenRouter (z-ai/glm-5.3-flash)$0.09$0.30টোকেন অনুযায়ী
JoinGonka Gateway$0.0069$0.021টোকেন অনুযায়ী, Gonka নেটওয়ার্ক

দুই থেকে তিন অর্ডারের পার্থক্য কোনো মার্কেটিং রাউন্ডিং নয়, বরং ভিন্ন অর্থনীতি: কম্পিউটেশনগুলো বিকেন্দ্রীভূত নেটওয়ার্কের অংশগ্রহণকারীরা সম্পন্ন করে, যারা ডেটা সেন্টারের মার্জিনের বদলে সরাসরি কাজের ওপর উপার্জন করে। এটি কীভাবে কাজ করে এবং এর ব্যবহারের সীমাবদ্ধতা কোথায়, তা নিয়ে বিস্তারিত আলোচনা দেখুন সবচেয়ে সাশ্রয়ী AI API আর্টিকেলে।

JoinGonka সারিটি হলো Gonka নেটওয়ার্কে GLM-5.3 Flash-এর দাম: নেটওয়ার্কের সকল মডেলের জন্য একই ট্যারিফ প্রযোজ্য। এই পেজের সংখ্যাগুলো স্বয়ংক্রিয়ভাবে আপডেট হয়, তাই হাতে কিছু হিসাব করার প্রয়োজন নেই।

Gonka নেটওয়ার্কে GLM: GLM-5.3 Flash এবং সাধারণ প্রশ্নসমূহ

Gonka নেটওয়ার্ক Z.ai মডেলকে সার্ভ করে: zai-org/GLM-5.3-Flash যা governance-প্রস্তাব #101 দ্বারা গৃহীত হয়েছে এবং MiniMax M2.7 ও DeepSeek V4 Flash-এর পাশাপাশি গেটওয়ে দ্বারা প্রদান করা হয়। এই গাইডের প্রথম ভার্সনগুলোতে উল্লিখিত ফ্ল্যাগশিপ GLM-5.2 মেইনস্ট্রিম অপারেশনে আসেনি — নেটওয়ার্ক একই সিরিজের একটি হালকা ও দ্রুত মডেল বেছে নিয়েছে। Base URL এবং কী একই আছে: ZCode-এ শুধু custom provider-এ মডেলটি যোগ করলেই হবে।

মডেলটি সম্পর্কে: MIT লাইসেন্সের অধীনে ওপেন ওয়েটস, MoE আর্কিটেকচার, ৩২০বি প্যারামিটার (প্রতি টোকেনে ১৮বি সক্রিয়), হাইব্রিড স্পার্স এবং লিনিয়ার অ্যাটেনশন। প্রধান বৈশিষ্ট্য হলো এটি একটি reasoning-মডেল: উত্তর দেওয়ার আগে এটি চিন্তা করে এবং সাধারণ প্রশ্নের ক্ষেত্রেও চিন্তার প্রক্রিয়ায় কয়েকশ টোকেন খরচ হয়। ZCode-এর জন্য এর অর্থ দুটি বিষয়: মডেলের উত্তরের দৈর্ঘ্যের সীমা খুব কমাবেন না (ছোট উত্তরের জন্যও কমপক্ষে ৬০০ টোকেন) এবং দ্রুত পরিবর্তনের জন্য Thought Level কমিয়ে রাখুন — API লেভেলে এটি হলো reasoning_effort: low। মডেল এবং এর লিমিট সম্পর্কে বিস্তারিত দেখুন Gonka নেটওয়ার্কে GLM-5.3 Flash নিবন্ধে।

সাধারণ প্রশ্নসমূহ:

  • নতুন মডেলে ৪২৯ এরর বা কিউ (queue) কেন দেখা দেয়? — মডেলটি এখনো নেটওয়ার্কের ছোট একটি অংশে চলছে; পিক আওয়ারের সময় অনুরোধগুলো ফ্রি স্লটের জন্য অপেক্ষা করতে পারে। কয়েক সেকেন্ড পরে আবার চেষ্টা করুন — লোড ব্যালেন্সার একটি সচল নোড খুঁজে পাবে। বর্তমান অবস্থা দেখুন গেটওয়ে স্ট্যাটাস পেজে।
  • আর কী কী পাওয়া যায়? — GLM-5.3 Flash ছাড়াও MiniMax M2.7 এবং DeepSeek V4 Flash আছে: তিনটি মডেলই ZCode-এ একই custom provider-এর মাধ্যমে কাজ করে, এই গাইডের কনফিগারেশনটি সম্পূর্ণ কার্যকর।
  • প্রাইভেসি কেমন? — গেটওয়ে প্রম্পট বা উত্তরের কন্টেন্ট সংরক্ষণ করে না; স্ট্যাটিস্টিকসে শুধুমাত্র ব্যবহারের হিসাব থাকে।
  • Coding Plan কখন বেশি লাভজনক? — আপনি যদি একা কাজ করেন, Lite কোটার মধ্যে থাকেন এবং সমান্তরাল এজেন্ট না চালান, তবে ফিক্সড সাবস্ক্রিপশন সুবিধাজনক এবং অনুমানযোগ্য। আপনার ব্যবহারের ধরন অনুযায়ী হিসাব করুন: সক্রিয় এজেন্ট কাজ করলে নেটওয়ার্কের মাধ্যমে টোকেন পেমেন্ট অনেক সাশ্রয়ী হয়, আবার দিনে দু-একবার হালকা কোড পরিবর্তনের জন্য পার্থক্যের তেমন প্রভাব নাও পড়তে পারে।
  • এটি কি অন্যান্য টুলের জন্য উপযুক্ত? — হ্যাঁ: একই endpoint Claude Code, Cursor, Cline এবং যেকোনো OpenAI/Anthropic-সামঞ্জস্যপূর্ণ ক্লায়েন্টে কাজ করে।
ZCode 3.0 একটি উল্লেখযোগ্য এজেন্ট-ভিত্তিক IDE, কিন্তু এর নিজস্ব GLM Coding Plan কোটা-ভিত্তিক: ৫ ঘণ্টার উইন্ডোতে নির্দিষ্ট 'প্রম্পট', পিক আওয়ারের সময় ×৩ মাল্টিপ্লায়ার এবং লোয়ার টায়ারে মাত্র একটি সমান্তরাল অনুরোধ। কাজের চাপ যত বেশি হয়, এটি তত ব্যয়বহুল এবং অনির্দেশ্য হয়ে ওঠে। অফিসিয়াল BYOK এই সমস্যার সমাধান দেয়: JoinGonka Gateway-কে custom provider হিসেবে কানেক্ট করুন — এবং সেন্ট্রালাইজড API-এর তুলনায় শতগুণ কম দামে Gonka ডিসেন্ট্রালাইজড নেটওয়ার্কের মাধ্যমে টোকেনের জন্য পেমেন্ট করুন। GLM-5.3 Flash — Z.ai-এর নিজস্ব ওপেন reasoning-মডেল — ইতিমধ্যেই নেটওয়ার্কে উপলব্ধ, পাশাপাশি আছে MiniMax M2.7 এবং DeepSeek V4 Flash। বিনামূল্যে প্রাপ্ত স্টার্টিং টোকেন দিয়ে শুরু করুন।

আরও জানতে চান?

অন্যান্য বিভাগগুলি অন্বেষণ করুন অথবা এখনই GNK উপার্জন শুরু করুন।

ফ্রি টোকেন সংগ্রহ করুন →