Abschnitte der Wissensbasis ▾
Navigation
▸ Hier starten Nach RollenKategorien
- Cursor + Gonka AI – günstige LLM zum Codieren
- Claude Code + Gonka AI – LLM für das Terminal
- OpenClaw + Gonka AI – erschwingliche KI-Agenten
- OpenCode: eigenes Modell im Terminal
- Continue.dev + Gonka AI – AI für VS Code/JetBrains
- Cline + Gonka AI – KI-Agent in VS Code
- Aider + Gonka AI – Paarprogrammierung mit KI
- LangChain + Gonka AI – KI-Anwendungen für wenige Cent
- n8n + Gonka AI – Automatisierung mit günstiger KI
- Open WebUI + Gonka AI – Ihr eigenes ChatGPT
- LibreChat + Gonka AI — Open-Source ChatGPT
- Hermes Agent + DeepSeek im Gonka-Netzwerk — autonomer Agent für ein paar Cent
- Kilo Code + Gonka AI – KI-Agent in VS Code
- Roo Code + Gonka AI – Autonomer KI-Agent in VS Code
- LlamaIndex + Gonka AI – RAG-Anwendungen für kleines Geld
- PydanticAI + Gonka – typisierte KI-Agenten für kleines Geld
- Vercel AI SDK + Gonka AI – KI-Anwendungen mit TypeScript für kleines Geld
- TanStack AI + Gonka – KI-Anwendungen mit TypeScript für kleines Geld
- API Schnellstart — curl, Python, TypeScript
- JoinGonka Gateway — vollständige Übersicht
- Management Keys – SaaS auf Gonka
- Die günstigste AI API: Anbietervergleich 2026
- Wie man AI-Token und API-Schlüssel kauft: 3 Wege im Jahr 2026
- Cursor Pro Request-Limit erreicht — Analyse und eine günstige Alternative
- Claude Code ist günstiger — Rechnungsanalyse und Wechsel
- Cline verbrennt Geld — warum der Agent so viel verbraucht
- OpenClaw wird teuer — warum der Agent Tokens verbrennt und wie man spart
- OpenRouter: Günstige Alternative — Vergleich mit JoinGonka Gateway
- Das beste AI-Modell für Coding im Jahr 2026: Vergleich und Preise
- Günstige Alternative zu GitHub Copilot ohne Limits
- Günstige Alternative zu Windsurf ohne Credits und Limits
- Die günstigste API für AI-Agenten im Jahr 2026
- ZCode: günstige GLM-Inferenz anstelle des GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — eigener Endpoint statt Credits
- GitHub Copilot BYOK — eigene Modelle statt Kontingent
- Zed + JoinGonka Gateway — günstiges Inference im Editor
- Pi + JoinGonka Gateway — Terminal-Agent mit günstiger Inference
- Codex CLI: eigener Schlüssel statt Abonnement
- DeepSeek Harness: eigener Provider via JoinGonka Gateway
- MiniMax Code: MiniMax-Agent mit eigenem Schlüssel über Gonka
- Warp + JoinGonka Gateway — Terminal-Agent auf Ihrem eigenen Endpoint
- Trae + JoinGonka Gateway — Gonka-Netzwerkmodelle in der AI-IDE
- Cherry Studio + JoinGonka Gateway — Desktop AI-Client
- omp (Oh My Pi) + JoinGonka Gateway: Agent mit Modellrollen
- OpenHands + JoinGonka Gateway: Agent auf eigenem Endpunkt
- Qwen Code nach Schließung von qwen-oauth: Arbeit über JoinGonka Gateway
- Goose + JoinGonka Gateway: Eigener Provider und Schlüssel im Keyring
- Crush + JoinGonka Gateway: Charm-Agent auf Modellen des Gonka-Netzwerks
- Zoo Code + JoinGonka Gateway: Umzug von Roo Code auf Gonka-Modelle
- Kimi Code CLI: Moonshot AI Agent mit eigenem Schlüssel über Gonka
- Factory Droid + JoinGonka Gateway: BYOK mit Gonka Netzwerkmodellen
- MiMo Code + JoinGonka Gateway: Xiaomi Agent auf Gonka Netzwerkmodellen
Werkzeuge
GitHub Copilot BYOK — eigene Modelle statt Kontingent
BYOK (bring your own key) ist der offizielle Mechanismus von GitHub Copilot, der es ermöglicht, einen eigenen Modell-Provider anzuschließen und in Agenten-Sitzungen damit zu arbeiten, anstatt mit den integrierten GPT- und Claude-Modellen. Seit Januar 2026 wird jeder OpenAI-kompatible Endpunkt unterstützt, ab dem 23. Juni ist BYOK in der Copilot-App selbst in der Public Preview für alle kostenpflichtigen Pläne verfügbar, und ab dem 14. Juli auch in der JetBrains-Version. Das bedeutet, dass man Copilot als Hülle beibehalten und die Inferenz über das JoinGonka Gateway leiten kann — zu den Preisen des dezentralen Gonka-Netzwerks und ohne Verbrauch der Premium-Anfragen des Abonnements. In VS Code werden für BYOK weder ein Copilot-Plan noch ein GitHub-Account-Login benötigt.
Was bietet BYOK und wann benötigen Sie es
Das Copilot-Abonnement begrenzt Premium-Anfragen durch monatliche Limits: Agent-Sessions, Refactorings und mehrstufige Aufgaben verbrauchen das Kontingent am schnellsten. BYOK leitet diese Aufrufe an Ihren Anbieter um: Der Verbrauch wird nach dessen Preisen abgerechnet und belastet nicht das Copilot-Premium-Kontingent. Die Schlüssel werden im System-Keychain gespeichert und vom Interface nicht zurückgelesen.
BYOK ist sinnvoll, wenn Sie an das Limit stoßen, Modelle mit offenen Gewichten nutzen möchten oder ein Vielfaches weniger für Inference bezahlen: Das Gonka-Netzwerk bietet dieselben Open-Source-Modelle hunderte Male günstiger an als die Listenpreise der Anbieter — die aktuellen Preise finden Sie immer im Live-Preismodell des Gateways.
Chronologie: Was wurde wann eingeführt
| Wann | Was ist erschienen |
|---|---|
| November 2025 | BYOK in Public Preview: Anthropic, OpenAI, xAI, Microsoft Foundry; Modi Agent, Plan, Ask, Edit in VS Code, JetBrains, Eclipse, Xcode |
| Januar 2026 | Unterstützung für jeden OpenAI-kompatiblen Provider + AWS Bedrock und Google AI Studio; Modelle mit Responses API |
| 23. Juni 2026 | BYOK in der GitHub Copilot App — Public Preview für alle kostenpflichtigen Pläne |
| 18. Juni 2026 | VS Code: BYOK funktioniert ohne GitHub-Login und ohne Copilot-Plan; der Verbrauch erfolgt beim Provider und belastet nicht das Copilot-Anfragenkontingent |
| 14. Juli 2026 | Custom OpenAI-kompatible Endpunkte in Copilot für JetBrains — für alle Tarife |
JoinGonka Gateway Anbindung: Schritt-für-Schritt
Sie benötigen einen Schlüssel jg-… – er wird bei der Registrierung am Gateway zusammen mit 3M kostenlosen Start-Tokens ausgegeben, eine Karte ist nicht nötig. Schlüssel und Modell werden in jedem Copilot-Client separat festgelegt – unten drei Wege.
VS Code – Anbieter Custom Endpoint. Das ist der aktuelle Weg: Der bisherige Anbieter „OpenAI Compatible" und die Einstellung github.copilot.chat.customOAIModels sind als veraltet eingestuft.
| Schritt | Aktion |
|---|---|
| 1. Modell-Editor | Befehlspalette → Chat: Manage Language Models (oder das Zahnrad in der Chat-Modellliste) |
| 2. Anbieter | Add Models → Custom Endpoint; Gruppenname – zum Beispiel JoinGonka |
| 3. Schlüssel | Fügen Sie Ihren jg-… ein – VS Code legt ihn in seinem eigenen geschützten Speicher ab, nicht in einer Datei |
| 4. API-Typ | Chat Completions |
| 5. Modelle | VS Code öffnet chatLanguageModels.json – ersetzen Sie das Array "models" der neuen Gruppe durch den Block unten und speichern Sie die Datei |
| 6. Auswahl | Wählen Sie das Modell in der Chat-Modellliste; erscheint es nicht, starten Sie VS Code neu |
"models": [
{
"id": "deepseek-ai/DeepSeek-V4-Flash-0731",
"name": "DeepSeek V4 Flash (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 347232,
"maxOutputTokens": 32768
},
{
"id": "MiniMaxAI/MiniMax-M2.7",
"name": "MiniMax M2.7 (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 191808,
"maxOutputTokens": 8192
},
{
"id": "zai-org/GLM-5.3-Flash",
"name": "GLM 5.3 Flash (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 381808,
"maxOutputTokens": 8192
}
]maxInputTokens – das Kontextfenster des Modells abzüglich der Antwortobergrenze: Zusammen mit maxOutputTokens ergibt sich daraus das Fenster. Ohne toolCalling: true erscheint das Modell bei der Arbeit mit Agenten nicht in der Liste.
Copilot CLI – nur Umgebungsvariablen. Der Anbieter hat keine Konfigurationsdatei; die Werte werden in der Shell festgelegt, aus der Sie copilot starten:
export COPILOT_PROVIDER_BASE_URL=https://gate.joingonka.ai/v1
export COPILOT_PROVIDER_TYPE=openai
export COPILOT_PROVIDER_API_KEY=jg-your-key
export COPILOT_MODEL=deepseek-ai/DeepSeek-V4-Flash-0731
export COPILOT_PROVIDER_MAX_PROMPT_TOKENS=347232
export COPILOT_PROVIDER_MAX_OUTPUT_TOKENS=32768
copilotDie Namen COPILOT_PROVIDER_* liest nur Copilot CLI, daher beeinträchtigt diese Konfiguration Ihre übrigen Tools nicht. Vom Modell verlangt die CLI tool calling und streaming – das beherrschen alle Modelle des Netzwerks.
JetBrains – GitHub Copilot Plugin. Öffnen Sie Copilot Chat → Modellliste → Manage Models, wählen Sie den Anbieter mit OpenAI-kompatiblem Endpoint, klicken Sie auf Add Models und geben Sie die Base URL https://gate.joingonka.ai/v1, den Schlüssel jg-… und die Modell-ID ein. Klicken Sie auf Save, markieren Sie das Modell unter Ihrem Schlüssel und speichern Sie erneut – es erscheint in der Liste neben den integrierten Modellen.
Tipp. Der Befehl npx @joingonka/setup --tool copilot-byok gibt alle drei Abschnitte bereits mit Ihrem Schlüssel und den echten Limits des gewählten Modells aus – einschließlich eines fertigen "models"-Arrays für VS Code – und prüft mit einer Live-Anfrage, ob das Gateway Schlüssel und Modell akzeptiert. Dateien schreibt er nicht: Jeder Copilot-Client speichert den Schlüssel in seinem eigenen Speicher.
Welches Netzwerkmodell wählen
Alle drei Netzmodelle unterstützen streaming und tool calling. deepseek-ai/DeepSeek-V4-Flash-0731 — bietet einen der längsten Kontexte des Netzwerks (380K Token) und die größte Ausgabe von bis zu 32768 Token: Nutzen Sie es für große Repositories und lange Agenten-Sitzungen. MiniMaxAI/MiniMax-M2.7 — universell einsetzbar, Ausgabe bis zu 8192 Token. zai-org/GLM-5.3-Flash — das reasoning-Modell von Z.ai mit dem längsten Netzwerkkontext (390K Token): es denkt vor der Antwort nach, Ausgabe bis zu 8192 Token; ein Teil des Antwortbudgets fließt in den Denkprozess, reduzieren Sie daher nicht das Ausgabelimit in den Einstellungen.
Public Preview Einschränkungen — offen gesagt
BYOK deckt Agenten-Sitzungen und Chats ab; Inline-Vorschläge und die semantische Suche im Projekt verbleiben bei den Copilot-Modellen und erfordern ein GitHub-Konto — dies ist eine Einschränkung von Copilot selbst, nicht des Anbieters. In Copilot Business und Enterprise wird lokales BYOK durch Administratorrichtlinien verwaltet („Bring Your Own Language Model Key“): Wenn der Punkt nicht in der Schnittstelle vorhanden ist, ist er auf Organisationsebene deaktiviert. Vision-Aufgaben funktionieren über das Gateway nicht: Die Netzwerkmodelle sind textbasiert. Wenn ein Tool Anfragen im Responses API-Format sendet — akzeptiert das Gateway diese: POST /v1/responses, Streaming und Function Tools funktionieren. Wir speichern keine Dialoge, daher wird store ignoriert und previous_response_id gibt einen Fehler zurück — übergeben Sie die gesamte Historie im input.
Möchten Sie mehr erfahren?
Erkunden Sie andere Abschnitte oder beginnen Sie jetzt GNK zu verdienen.
Kostenlose Tokens erhalten →