ज्ञानकोश अनुभाग ▾

नेविगेशन

▸ यहाँ से शुरू करें भूमिका के अनुसार

श्रेणियाँ

उपकरण 37
शब्दावली 12

उपकरण

वेरसेल AI SDK + गोंका AI - बहुत कम लागत पर टाइपस्क्रिप्ट पर AI-अनुप्रयोग

Vercel AI SDK, TypeScript और JavaScript में AI-एप्लिकेशन बनाने के लिए सबसे लोकप्रिय SDK है। एकीकृत API generateText और streamText, UI में स्ट्रीमिंग, नेटिव tool calling, Next.js App Router के लिए तैयार हेल्पर्स — चैटबॉट्स, एजेंट्स और वेब पर RAG-पाइपलाइन्स के लिए सब कुछ मौजूद है।

समस्या वही है जो किसी भी LLM-एप्लिकेशन के साथ है — प्रोवाइडर की कीमत। स्ट्रीमिंग चैट इंटरफेस हर संदेश पर संवाद का इतिहास भेजता है, एजेंट दर्जनों चरणों में कॉन्टेक्स्ट चलाता है। Anthropic ($3-15/1M) और OpenAI ($2.5-10/1M) की कीमतों पर, प्रोडक्शन में एक साधारण पेट-प्रोजेक्ट भी महीने में सैकड़ों डॉलर का बिल बन जाता है।

JoinGonka GatewayGonka विकेंद्रीकृत नेटवर्क के ऊपर एक OpenAI-संगत एंडपॉइंट है। Vercel AI SDK इससे किसी भी OpenAI-संगत प्रोवाइडर की तरह जुड़ता है — बिना फोर्क के, बिना अपने एडेप्टर के। कमर्शियल होस्टर्स जैसे ही ओपन मॉडल — MiniMax M2.7, DeepSeek V4 Flash और GLM-5.3 Flash — वही streamText, लेकिन $0.0069/1M इनपुट टोकन पर — दर्जनों गुना सस्ता।

चरण 1: कुंजी प्राप्त करें और प्रदाता को कनेक्ट करें

JoinGonka API-की: gate.joingonka.ai/register पर रजिस्टर करें — शुरुआत में हम 3M मुफ्त टोकन देते हैं। Dashboard में jg- प्रीफिक्स के साथ एक की (key) बनाएं।

पैकेज इंस्टॉलेशन। कस्टम OpenAI-संगत एंडपॉइंट के लिए Vercel AI SDK प्रदाता @ai-sdk/openai-compatible की सलाह देता है:

npm install ai @ai-sdk/openai-compatible

न्यूनतम कनेक्शनcreateOpenAICompatible के माध्यम से प्रदाता का इंस्टेंस बनाएं और generateText को कॉल करें:

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';
import { generateText } from 'ai';

const gonka = createOpenAICompatible({
  name: 'gonka',
  baseURL: 'https://gate.joingonka.ai/v1',
  apiKey: process.env.GONKA_API_KEY, // jg-आपकी-की
});

const { text } = await generateText({
  model: gonka('MiniMaxAI/MiniMax-M2.7'),
  prompt: 'विकेंद्रीकृत इन्फरेंस नेटवर्क क्या है, समझाएं',
});

console.log(text);

apiKey पैरामीटर स्वचालित रूप से Authorization: Bearer jg-आपकी-की हेडर जोड़ता है — अलग से कॉन्फ़िगरेशन की आवश्यकता नहीं है। की (key) को कोड में रखने के बजाय GONKA_API_KEY पर्यावरण वेरिएबल (जैसे .env.local) में स्टोर करें।

विकल्पcreateOpenAI({ baseURL, apiKey }) फैक्ट्री के साथ @ai-sdk/openai पैकेज। दोनों तरीके काम करते हैं; OpenAI के अलावा अन्य एंडपॉइंट्स के लिए, AI SDK दस्तावेज़ीकरण @ai-sdk/openai-compatible की सलाह देता है — यह अनावश्यक OpenAI-विशिष्ट धारणाओं को नहीं जोड़ता है।

चरण 2: स्ट्रीमिंग और Next.js रूट हैंडलर

Vercel AI SDK की मुख्य विशेषता स्ट्रीमिंग रिस्पॉन्स है। streamText फ़ंक्शन टोकन्स को तुरंत स्ट्रीम करना शुरू कर देता है, और toUIMessageStreamResponse() हेल्पर Next.js App Router में रूट हैंडलर से सीधे तैयार स्ट्रीम प्रदान करता है।

सर्वर हैंडलर app/api/chat/route.ts:

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';
import { streamText, convertToModelMessages, type UIMessage } from 'ai';

const gonka = createOpenAICompatible({
  name: 'gonka',
  baseURL: 'https://gate.joingonka.ai/v1',
  apiKey: process.env.GONKA_API_KEY,
});

// 30 सेकंड तक स्ट्रीमिंग की अनुमति दें
export const maxDuration = 30;

export async function POST(req: Request) {
  const { messages }: { messages: UIMessage[] } = await req.json();

  const result = streamText({
    model: gonka('MiniMaxAI/MiniMax-M2.7'),
    system: 'आप एक सहायक असिस्टेंट हैं। संक्षेप में और सटीक उत्तर दें।',
    messages: convertToModelMessages(messages),
    maxOutputTokens: 8192, // गेटवे के माध्यम से आउटपुट सीमा
  });

  return result.toUIMessageStreamResponse();
}

क्लाइंट-साइड पर @ai-sdk/react से useChat हुक कनेक्ट करें — यह /api/chat को कॉल करता है और मैसेज स्ट्रीम को रेंडर करता है। इस दौरान बैकएंड OpenAI के बजाय Gonka से जुड़ता है।

बिना UI के स्क्रिप्ट (Node, स्ट्रीम पर async-iterator):

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';
import { streamText } from 'ai';

const gonka = createOpenAICompatible({
  name: 'gonka',
  baseURL: 'https://gate.joingonka.ai/v1',
  apiKey: process.env.GONKA_API_KEY,
});

const result = streamText({
  model: gonka('MiniMaxAI/MiniMax-M2.7'),
  prompt: 'डिस्ट्रिब्यूटेड कंप्यूटिंग पर एक हाइकू लिखें',
});

for await (const chunk of result.textStream) {
  process.stdout.write(chunk);
}

मॉडल पैरामीटर्स। गेटवे के माध्यम से तीन मॉडल उपलब्ध हैं: MiniMax M2.7 के लिए 200K टोकन का कॉन्टेक्स्ट, DeepSeek V4 Flash के लिए 380K और GLM-5.3 Flash के लिए 390K; उत्तर की सीमा (maxOutputTokens) — MiniMax M2.7 और GLM-5.3 Flash के लिए 8192, DeepSeek V4 Flash के लिए 32768:

  • MiniMaxAI/MiniMax-M2.7 — डिफ़ॉल्ट (MiniMax M2.7);
  • deepseek-ai/DeepSeek-V4-Flash-0731 (DeepSeek V4 Flash, 380K कॉन्टेक्स्ट);
  • zai-org/GLM-5.3-Flash (GLM-5.3 Flash, रीजनिंग मॉडल — उत्तर देने से पहले तर्क करता है)।

यदि maxOutputTokens सेट नहीं है, तो नॉन-स्ट्रीम अनुरोध के लिए गेटवे डिफ़ॉल्ट रूप से 1500 टोकन तक लौटाएगा — स्ट्रीमिंग चैट के लिए मान को स्पष्ट रूप से निर्दिष्ट करना बेहतर है।

लागत की तुलना

Vercel AI SDK आमतौर पर इंटरैक्टिव इंटरफेस के पीछे होता है — चैट, एजेंट, एप्लिकेशन में असिस्टेंट। प्रत्येक संदेश संवाद के इतिहास को खींचता है, एजेंट का प्रत्येक चरण — टूल्स का संदर्भ। इसलिए वास्तविक लागत एक अनुरोध के बजाय प्रोडक्शन लोड के आधार पर गिनी जाती है। आइए सामान्य परिदृश्यों की तुलना करें:

परिदृश्यटोकनAnthropic / OpenAIJoinGonka Gonka
चैट में एक संदेश~3K$0.01 — $0.05$0.000028
20 संवादों का डायलॉग~150K$0.50 — $2.25$0.0014
RAG-उत्तर (खोज + जनरेशन)~5K$0.015 — $0.05$0.000048
टूल कॉलिंग के साथ एजेंट का चरण~10K$0.03 — $0.10$0.000096
प्रति दिन 10 000 अनुरोध (प्रोड)~50M$150 — $500$0.48

JoinGonka की कीमत — इनपुट पर 1M टोकन के लिए लगभग $0.0069, आउटपुट लगभग तीन गुना महंगा है। प्रति दिन हजारों अनुरोध वाले एप्लिकेशन के लिए यह सैकड़ों डॉलर के बिल और सेंट के बिल के बीच का अंतर है। 3M मुफ्त टोकन प्रोजेक्ट के पहले अनुरोधों को चलाने के लिए पर्याप्त हैं।

टूल कॉलिंग और एजेंट

Vercel AI SDK उपकरणों को tools ऑब्जेक्ट और zod स्कीम के माध्यम से घोषणात्मक रूप से वर्णित करता है। नेटवर्क के मॉडल नेटिव function calling का समर्थन करते हैं, इसलिए AI SDK टेक्स्ट रिस्पॉन्स को पार्स किए बिना स्ट्रक्चर्ड tool_calls प्राप्त करता है। पैरामीटर stopWhen: stepCountIs(n) एक के बाद एक कई चरणों की अनुमति देता है — मॉडल टूल कॉल करता है, परिणाम प्राप्त करता है और जारी रखता है।

import { createOpenAICompatible } from '@ai-sdk/openai-compatible';
import { generateText, tool, stepCountIs } from 'ai';
import { z } from 'zod';

const gonka = createOpenAICompatible({
  name: 'gonka',
  baseURL: 'https://gate.joingonka.ai/v1',
  apiKey: process.env.GONKA_API_KEY,
});

const { text } = await generateText({
  model: gonka('MiniMaxAI/MiniMax-M2.7'),
  stopWhen: stepCountIs(5),
  tools: {
    weather: tool({
      description: 'शहर का मौसम जानें',
      inputSchema: z.object({ city: z.string() }),
      execute: async ({ city }) => ({ city, tempC: 17 }),
    }),
  },
  prompt: 'मॉस्को में मौसम कैसा है? एक वाक्य में उत्तर दें।',
});

console.log(text);

मॉडल weather टूल को कॉल करता है, परिणाम प्राप्त करता है और अंतिम उत्तर बनाता है। पूरा चक्र Gonka के माध्यम से लगभग $0.000048 का है, जबकि Anthropic या OpenAI पर यह $0.03-0.10 है। एजेंट-आधारित एप्लिकेशन के लिए, जहाँ हर उपयोगकर्ता अनुरोध 5-10 चरणों में बदल जाता है, प्रोडक्शन पर बचत हज़ारों डॉलर प्रति माह हो सकती है।

यदि आप Python पर AI-एप्लिकेशन बना रहे हैं, तो LangChain पर गाइड देखें — वहाँ OpenAI-संगत क्लास के माध्यम से यही तरीका अपनाया गया है।

Vercel AI SDK + Gonka = TypeScript में प्रोडक्शन-रेडी AI-एप्लीकेशन बहुत कम खर्च में। createOpenAICompatible बिना फोर्क के Gateway को कनेक्ट करता है, generateText और streamText सामान्य रूप से काम करते हैं, नेटिव tool calling और Next.js route handlers — सब कुछ OpenAI और Anthropic के $2.5-15 के बजाय $0.0069/1M टोकन पर उपलब्ध है।

अधिक जानना चाहते हैं?

अन्य अनुभागों का अन्वेषण करें या अभी GNK कमाना शुरू करें।

मुफ्त टोकन प्राप्त करें →