علم کے مرکز کے حصے ▾
نیویگیشن
▸ یہاں سے شروع کریں کردار کے لحاظ سےزمرہ جات
- Cursor + Gonka AI – کوڈنگ کے لیے سستا LLM
- Claude Code + Gonka AI – ٹرمینل کے لیے LLM
- OpenClaw + Gonka AI – سستے AI ایجنٹس
- OpenCode: ٹرمینل میں اپنا ماڈل
- Continue.dev + Gonka AI – VS Code/JetBrains کے لیے AI
- Cline + Gonka AI – VS Code میں AI ایجنٹ
- Aider + Gonka AI – AI کے ساتھ جوڑا پروگرامنگ
- LangChain + Gonka AI – AI ایپلیکیشنز بہت کم قیمت پر
- n8n + Gonka AI – سستے AI کے ساتھ آٹومیشن
- Open WebUI + Gonka AI – اپنا ChatGPT
- LibreChat + Gonka AI — اوپن سورس ChatGPT
- Hermes Agent + DeepSeek, Gonka نیٹ ورک پر — انتہائی کم قیمت میں خودمختار ایجنٹ
- Kilo Code + Gonka AI — VS Code میں AI ایجنٹ
- Roo Code + Gonka AI — VS Code میں خودمختار AI ایجنٹ
- لاما انڈیکس + گونکا AI — RAG-ایپلی کیشنز صرف چند روپے میں
- PydanticAI + گونکا — ٹائپ شدہ AI-ایجنٹ صرف چند روپے میں
- Vercel AI SDK + گونکا AI — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
- TanStack AI + گونکا — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
- API فوری آغاز — curl, Python, TypeScript
- JoinGonka Gateway — مکمل جائزہ
- مینجمنٹ کیز — Gonka پر SaaS
- سب سے سستا AI API: 2026 کے فراہم کنندگان کا موازنہ
- Cursor Pro کوٹہ ختم — تجزیہ اور سستا متبادل
- Claude Code سستا ہے — بل کا تجزیہ اور تبدیلی
- Cline پیسے ضائع کر رہا ہے — ایجنٹ اتنا زیادہ خرچ کیوں کرتا ہے
- OpenClaw مہنگا ہے — کیوں ایجنٹ ٹوکن ضائع کرتا ہے اور کیسے بچت کریں
- OpenRouter: سستا متبادل — JoinGonka Gateway کے ساتھ موازنہ
- کوڈنگ 2026 کے لیے بہترین AI-ماڈل: موازنہ اور قیمتیں
- حدود کے بغیر GitHub Copilot کا سستا متبادل
- کریڈٹ اور حدود کے بغیر Windsurf کا سستا متبادل
- 2026 میں AI-ایجنٹس کے لیے سب سے سستا API
- ZCode: GLM Coding Plan کی بجائے سستا GLM-inferenced
- JetBrains IDE + JoinGonka Gateway — کریڈٹس کے بجائے اپنا endpoint
- GitHub Copilot BYOK — کوٹہ کے بجائے اپنے ماڈلز
- Zed + JoinGonka Gateway — ایڈیٹر میں سستا انفیرنس
- Pi + JoinGonka Gateway — سستے انفرنس پر ٹرمینل ایجنٹ
- Codex CLI: سبسکرپشن کے بجائے اپنی کی (key)
ٹولز
TanStack AI + گونکا — TypeScript پر AI-ایپلی کیشنز صرف چند روپے میں
TanStack AI (@tanstack/ai) — TanStack ٹیم (Query, Router, Table کے تخلیق کار) کی طرف سے TypeScript کے لیے ایک ٹائپ-سیف (type-safe) SDK ہے۔ Provider-agnostic آرکیٹیکچر: اسٹریمنگ چیٹ، نیٹو tool calling، ایجنٹس، اسٹرکچرڈ آؤٹ پٹ اور ایک سنگل اڈاپٹر سیٹ کے ذریعے ملٹی موڈیلیٹی۔ React, Vue, Svelte, Solid اور Preact (useChat اور دیگر ہکس) کے لیے تیار بائنڈنگز اور سرور کے لیے ہیڈلیس کلائنٹ۔
کسی بھی AI-فریم ورک کی طرح یہاں بھی مسئلہ وہی ہے — انفرنس (inference) کی قیمت۔ TanStack AI ڈیفالٹ طور پر OpenAI, Anthropic اور Gemini کو سپورٹ کرتا ہے، لیکن ان پرووائیڈرز کے براہ راست ریٹس ($2.50–15 فی 1M ٹوکنز) پروڈکشن چیٹس اور ایجنٹس کو مہنگا بنا دیتے ہیں: اسٹریمنگ ڈائیلاگز اور ٹول-سائیکلز تیزی سے لاکھوں ٹوکنز خرچ کر دیتے ہیں۔
TanStack AI کی کلیدی خصوصیت — openaiCompatible() فنکشن: کسی بھی OpenAI-مطابقت پذیر اینڈ پوائنٹ کو جوڑنے کا بہترین طریقہ۔ اس کا مطلب ہے کہ JoinGonka Gateway بغیر کسی کسٹم اڈاپٹر کے انٹیگریٹ ہو جاتا ہے — بس baseURL، کلید اور ماڈلز کی فہرست فراہم کریں۔ نتیجہ: وہی ٹائپ-سیف چیٹ اور ایجنٹس، لیکن OpenAI کے $2.50–15 کے بجائے Gonka کے ڈی سینٹرلائزڈ نیٹ ورک کے ذریعے 1M ٹوکنز پر $0.0069 کی قیمت پر۔
مرحلہ 1: TanStack AI انسٹال کریں اور کلید حاصل کریں
پیکیج انسٹالیشن (کور + OpenAI-اڈاپٹر، جہاں openaiCompatible موجود ہے):
# pnpm
pnpm add @tanstack/ai @tanstack/ai-openai
# npm
npm install @tanstack/ai @tanstack/ai-openaiReact میں چیٹ انٹرفیس کے لیے کلائنٹ اور ہکس شامل کریں:
pnpm add @tanstack/ai-client @tanstack/ai-reactJoinGonka API-key: اگر ابھی تک نہیں ہے — gate.joingonka.ai/register پر رجسٹر کریں، 3M مفت ٹوکنز حاصل کریں اور Dashboard → API Keys میں jg-xxx کی (key) بنائیں۔ ایک ہی کی اور بیلنس OpenAI اور Anthropic دونوں فارمیٹس کے لیے کام کرتا ہے۔
مرحلہ 2: openaiCompatible کے ذریعے Gonka کو منسلک کریں
TanStack AI میں کسٹم OpenAI-مطابقت پذیر پرووائیڈر openaiCompatible() فنکشن کے ذریعے سیٹ اپ کیا جاتا ہے: آپ ایک بار baseURL، apiKey اور ماڈلز کی فہرست سیٹ کرتے ہیں، اور پھر ہر کال پر ماڈل منتخب کرتے ہیں۔ ہمارا گیٹ وے Chat Completions فارمیٹ استعمال کرتا ہے، اس لیے ہم api: 'chat-completions' کو برقرار رکھتے ہیں (یہ ڈیفالٹ ویلیو ہے)۔
import { openaiCompatible } from '@tanstack/ai-openai'
// Gonka پرووائیڈر — ایک بار سیٹ اپ ہوتا ہے
export const gonka = openaiCompatible({
name: 'gonka',
baseURL: 'https://gate.joingonka.ai/v1',
apiKey: process.env.GONKA_API_KEY!, // jg-آپکی-کی
api: 'chat-completions',
models: [
'MiniMaxAI/MiniMax-M2.7', // ڈیفالٹ
'deepseek-ai/DeepSeek-V4-Flash-0731',
'zai-org/GLM-5.3-Flash', // ریزننگ ماڈل
],
})سرور پر سٹریمنگ چیٹ (مثال کے طور پر، کسی بھی فل سٹیک فریم ورک یا TanStack Start میں راؤٹ ہینڈلر)۔ جواب کی لمبائی modelOptions کے ذریعے سیٹ کی جاتی ہے — یہ نیٹو وائر پیرامیٹرز (max_tokens، temperature) کے لیے واحد مقام ہے:
import { chat, toServerSentEventsResponse } from '@tanstack/ai'
import { gonka } from './gonka'
export async function POST(request: Request) {
const { messages } = await request.json()
const stream = chat({
adapter: gonka('MiniMaxAI/MiniMax-M2.7'),
messages,
modelOptions: { max_tokens: 8192 }, // گیٹ وے کے ذریعے آؤٹ پٹ کی حد
})
return toServerSentEventsResponse(stream)
}React-کلائنٹ useChat ہک کے ذریعے — سرور سے UI تک جوابات سٹریم کرتا ہے:
import { useChat } from '@tanstack/ai-react'
function Chat() {
const { messages, sendMessage, status } = useChat({ api: '/api/chat' })
return (
<div>
{messages.map((m) => (
<p key={m.id}><b>{m.role}:</b> {m.content}</p>
))}
<button onClick={() => sendMessage('Gonka کیا ہے؟')}>
پوچھیں
</button>
</div>
)
}بغیر سرور کے: وہی پرووائیڈر سکرپٹ یا بیک اینڈ میں براہِ راست کام کرتا ہے — بس chat() کال کریں اور سٹریم پڑھیں۔ Gonka کے ساتھ کنکشن تمام طریقوں کے لیے ایک جیسا ہے۔
گیٹ وے کے ذریعے ماڈلز کے پیرامیٹرز: کانٹیکسٹ — MiniMax M2.7 کے لیے 200K ٹوکنز، DeepSeek V4 Flash کے لیے 380K اور GLM-5.3 Flash کے لیے 390K۔ max_tokens کی حد — MiniMax M2.7 اور GLM-5.3 Flash کے لیے 8192، DeepSeek V4 Flash کے لیے 32768۔ اگر max_tokens کا ذکر نہ ہو، تو نان-سٹریم کے لیے ڈیفالٹ 1500 ہے، اس لیے طویل جوابات کے لیے اسے واضح طور پر سیٹ کریں۔
لاگت کا موازنہ
TanStack AI براہ راست OpenAI/Anthropic ریٹس اور Gonka کے ذریعے یکساں طور پر کام کرتا ہے — صرف baseURL تبدیل ہوتا ہے۔ لیکن قیمت میں زمین آسمان کا فرق ہے۔ TanStack AI پر عام پروڈکشن ایپلیکیشن کے لوڈ کا موازنہ کریں:
| منظرنامہ | ٹوکنز | OpenAI / Anthropic | JoinGonka Gonka |
|---|---|---|---|
| چیٹ کا ایک اسٹریمنگ جواب | ~3K | $0.008 — $0.045 | $0.000028 |
| tool calling کے ساتھ ایجنٹ سائیکل | ~15K | $0.04 — $0.22 | $0.00014 |
| دن میں 1,000 مکالمے | ~3M | $7.50 — $45 | $0.028 |
| ماہانہ پروڈکشن (~100M) | ~100M | $250 — $1 500 | $0.96 |
TanStack AI کا provider-agnostic طریقہ کار یہ ہے کہ Gonka پر سوئچ کرنا کوڈ کو دوبارہ لکھنا نہیں، بلکہ صرف ایک لائن (baseURL) کو تبدیل کرنا ہے۔ اسی وقت آپ کے ٹائپ-سیف ٹولز، اسٹرکچرڈ آؤٹ پٹ اور React-ہکس برقرار رہتے ہیں۔ ہزاروں صارفین والی ایپلیکیشن کے لیے، یہ ماہانہ ہزاروں ڈالر کی بچت ہے۔
Gonka کی قیمت: ان پٹ پر فی 1M ٹوکنز تقریباً $0.0069، آؤٹ پٹ پر ×3۔ یہ OpenAI اور Anthropic کے براہ راست ریٹس سے سینکڑوں سے ہزار گنا سستا ہے۔
ٹائپ-سیف ٹولز اور ماڈل کا انتخاب
TanStack AI کی بنیادی خصوصیت ایک متحد toolDefinition() کنٹریکٹ ہے: ٹول کی وضاحت ایک بار کی جاتی ہے (Zod, ArkType, Valibot یا JSON Schema کے ذریعے ان پٹ/آؤٹ پٹ)، اور اس کا نفاذ سرور یا کلائنٹ پر منسلک کیا جاتا ہے۔ MiniMax M2.7, DeepSeek V4 Flash اور GLM-5.3 Flash، Gonka کے ذریعے مقامی ٹول کالنگ (native tool calling) کو سپورٹ کرتے ہیں، اس لیے ایجنٹس ٹیکسٹ رسپانس کو پارس کیے بغیر قابل اعتماد طریقے سے کام کرتے ہیں۔
import { chat, toolDefinition } from '@tanstack/ai'
import { gonka } from './gonka'
import { z } from 'zod'
const getWeather = toolDefinition({
name: 'getWeather',
description: 'شہر کا موسم جانیں',
inputSchema: z.object({ city: z.string() }),
outputSchema: z.object({ tempC: z.number() }),
}).server(async ({ city }) => {
return { tempC: 21 } // آپ کی اصل API کال
})
const stream = chat({
adapter: gonka('MiniMaxAI/MiniMax-M2.7'),
messages: [{ role: 'user', content: 'ماسکو میں موسم کیسا ہے؟' }],
tools: [getWeather],
modelOptions: { max_tokens: 8192 },
})کون سا ماڈل منتخب کریں:
- MiniMaxAI/MiniMax-M2.7 — ڈیفالٹ، رفتار اور معیار کا توازن، طویل سیاق و سباق (context)۔ رسپانس کی حد 8192۔
- deepseek-ai/DeepSeek-V4-Flash-0731 — نیٹ ورک کا سب سے طویل سیاق و سباق (380K)، سستے بڑے پرامپٹس۔ رسپانس کی حد 32768۔
- zai-org/GLM-5.3-Flash — ریزننگ ماڈل (reasoning-model): جواب دینے سے پہلے سوچتا ہے، پیچیدہ منطق میں مضبوط؛ نیٹ ورک کا سب سے طویل سیاق و سباق (390K)۔ رسپانس کی حد 8192؛ ریزننگ
max_tokensکا ایک حصہ استعمال کرتی ہے۔
TanStack AI میں رن ٹائم اڈاپٹر سوئچنگ کی بدولت، آپ تینوں ماڈلز کو ایک ہی پرووائیڈر میں رکھ سکتے ہیں اور فوری طور پر ان کے درمیان سوئچ کر سکتے ہیں—مثال کے طور پر، ریزننگ کے کاموں کے لیے GLM-5.3 Flash اور تیز تر جوابات کے لیے MiniMax کا استعمال کریں۔