Abschnitte der Wissensbasis ▾
Navigation
▸ Hier starten Nach RollenKategorien
- Cursor + Gonka AI – günstige LLM zum Codieren
- Claude Code + Gonka AI – LLM für das Terminal
- OpenClaw + Gonka AI – erschwingliche KI-Agenten
- OpenCode: eigenes Modell im Terminal
- Continue.dev + Gonka AI – AI für VS Code/JetBrains
- Cline + Gonka AI – KI-Agent in VS Code
- Aider + Gonka AI – Paarprogrammierung mit KI
- LangChain + Gonka AI – KI-Anwendungen für wenige Cent
- n8n + Gonka AI – Automatisierung mit günstiger KI
- Open WebUI + Gonka AI – Ihr eigenes ChatGPT
- LibreChat + Gonka AI — Open-Source ChatGPT
- Hermes Agent + DeepSeek im Gonka-Netzwerk — autonomer Agent für ein paar Cent
- Kilo Code + Gonka AI – KI-Agent in VS Code
- Roo Code + Gonka AI – Autonomer KI-Agent in VS Code
- LlamaIndex + Gonka AI – RAG-Anwendungen für kleines Geld
- PydanticAI + Gonka – typisierte KI-Agenten für kleines Geld
- Vercel AI SDK + Gonka AI – KI-Anwendungen mit TypeScript für kleines Geld
- TanStack AI + Gonka – KI-Anwendungen mit TypeScript für kleines Geld
- API Schnellstart — curl, Python, TypeScript
- JoinGonka Gateway — vollständige Übersicht
- Management Keys – SaaS auf Gonka
- Die günstigste AI API: Anbietervergleich 2026
- Wie man AI-Token und API-Schlüssel kauft: 3 Wege im Jahr 2026
- Cursor Pro Request-Limit erreicht — Analyse und eine günstige Alternative
- Claude Code ist günstiger — Rechnungsanalyse und Wechsel
- Cline verbrennt Geld — warum der Agent so viel verbraucht
- OpenClaw wird teuer — warum der Agent Tokens verbrennt und wie man spart
- OpenRouter: Günstige Alternative — Vergleich mit JoinGonka Gateway
- Das beste AI-Modell für Coding im Jahr 2026: Vergleich und Preise
- Günstige Alternative zu GitHub Copilot ohne Limits
- Günstige Alternative zu Windsurf ohne Credits und Limits
- Die günstigste API für AI-Agenten im Jahr 2026
- ZCode: günstige GLM-Inferenz anstelle des GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — eigener Endpoint statt Credits
- GitHub Copilot BYOK — eigene Modelle statt Kontingent
- Zed + JoinGonka Gateway — günstiges Inference im Editor
- Pi + JoinGonka Gateway — Terminal-Agent mit günstiger Inference
- Codex CLI: eigener Schlüssel statt Abonnement
- DeepSeek Harness: eigener Provider via JoinGonka Gateway
- MiniMax Code: MiniMax-Agent mit eigenem Schlüssel über Gonka
- Warp + JoinGonka Gateway — Terminal-Agent auf Ihrem eigenen Endpoint
- Trae + JoinGonka Gateway — Gonka-Netzwerkmodelle in der AI-IDE
- Cherry Studio + JoinGonka Gateway — Desktop AI-Client
- omp (Oh My Pi) + JoinGonka Gateway: Agent mit Modellrollen
- OpenHands + JoinGonka Gateway: Agent auf eigenem Endpunkt
- Qwen Code nach Schließung von qwen-oauth: Arbeit über JoinGonka Gateway
- Goose + JoinGonka Gateway: Eigener Provider und Schlüssel im Keyring
- Crush + JoinGonka Gateway: Charm-Agent auf Modellen des Gonka-Netzwerks
- Zoo Code + JoinGonka Gateway: Umzug von Roo Code auf Gonka-Modelle
- Kimi Code CLI: Moonshot AI Agent mit eigenem Schlüssel über Gonka
- Factory Droid + JoinGonka Gateway: BYOK mit Gonka Netzwerkmodellen
- MiMo Code + JoinGonka Gateway: Xiaomi Agent auf Gonka Netzwerkmodellen
Tools
Warp + JoinGonka Gateway — Terminal-Agent auf Ihrem eigenen Endpoint
Warp ist ein Terminal, das sich zu einer Entwicklungsumgebung für Agenten weiterentwickelt hat: Der integrierte Warp Agent liest Befehlsausgaben, bearbeitet Dateien, startet Builds und führt Aufgaben von der Anfrage bis zum Ergebnis aus. Standardmäßig arbeitet der Agent mit Modellen, die Warp selbst verkauft – gegen Tarif-Credits. Das Einbinden eines eigenen Inference-Endpoints war lange Zeit nur in kostenpflichtigen Tarifen und nur mit API-Schlüsseln von OpenAI, Anthropic oder Google möglich. Am 20. Mai 2026 hat Warp BYOK für den kostenlosen Tarif freigeschaltet und einen custom inference endpoint hinzugefügt – die Anbindung jedes Dienstes, der das OpenAI Chat Completions-Protokoll unterstützt.
Die zweite Methode ist genau das, was benötigt wird, um den Warp-Agenten über das JoinGonka Gateway laufen zu lassen: Das Gateway stellt die Modelle des dezentralen Gonka-Netzwerks über eine OpenAI-kompatible API bereit, die Inference wird zu den Echtzeitpreisen des Netzwerks bezahlt, und für Einzelentwickler sowie kleine Teams werden keine Warp-Credits verbraucht. Nach der Registrierung und Bestätigung Ihrer Adresse erhalten Sie 3M kostenlose Token – genug, um den Agenten bei Ihren Aufgaben zu testen, bevor Sie das erste Mal aufladen.
Nachfolgend erfahren Sie, was Sie vor dem Start benötigen, welche Werte Sie in das Warp-Formular eintragen müssen, wie Sie sicherstellen, dass die Anfragen über das Gateway laufen, welches Netzwerk-Modell Sie für Terminal-Aufgaben wählen sollten und was bei der Anfrageroute zu beachten ist: Diese ist bei Warp anders konfiguriert als bei den meisten anderen Tools.
Was Sie benötigen: Schlüssel, Warp-Tarif und eine öffentliche Adresse
JoinGonka-Schlüssel. Registrieren Sie sich am Gateway, öffnen Sie im Dashboard den Bereich „API-Keys“ und klicken Sie auf „Key erstellen“. Der Schlüssel beginnt mit jg- und wird nur einmal angezeigt – speichern Sie ihn sofort. Es ist sinnvoll, einen eigenen Schlüssel für Warp zu erstellen: So ist im Bereich „Nutzung“ der Verbrauch des Terminal-Agenten als separate Zeile sichtbar und vermischt sich nicht mit anderen Tools.
Warp-Tarif. Ein eigener Endpoint ist nicht nur in kostenpflichtigen Tarifen verfügbar – die Bedingungen hängen von der Teamgröße ab:
| Wer bindet an | Ist ein eigener Endpoint verfügbar? | Was passiert mit Warp-Credits? |
|---|---|---|
| Einzelentwickler oder Unternehmen bis 10 Personen (Tarife Free, Build, Max) | Ja, in jedem dieser Tarife | Für die Inference über einen eigenen Endpoint werden keine Credits abgebucht |
| Organisation mit mehr als 10 Personen | Nur bei Business oder Enterprise | Lokale Agenten-Starts verbrauchen platform credits – eine Gebühr für die Warp-Infrastruktur zu einem reduzierten Satz; die Inference selbst wird direkt beim Endpoint-Anbieter bezahlt |
Öffentliche HTTPS-Adresse. Dies ist eine Anforderung von Warp, die man leicht übersieht: Anfragen an Ihren Endpoint werden nicht von der Anwendung auf Ihrem Rechner gesendet, sondern von den Warp-Servern. Daher muss die Adresse aus dem Internet erreichbar sein. localhost, 127.0.0.1 und private Netzwerkadressen werden vom Formular abgelehnt, und das Schema muss zwingend https:// sein. Das JoinGonka Gateway ist ein öffentlicher HTTPS-Dienst, daher werden Tunnel wie ngrok, die in der Warp-Dokumentation für lokale Modelle empfohlen werden, hier nicht benötigt.
Aktuelle Anwendungsversion. Der eigene Endpoint ist in stabilen Builds seit dem Release vom 20. Mai 2026 enthalten, die Auswahl des API-Schemas im Formular wurde mit dem Release vom 31. Juli 2026 hinzugefügt. Falls das Feld „API schema“ im Formular fehlt, aktualisieren Sie Warp.
Verbindung: Add custom endpoint Formular
Die gesamte Einrichtung erfolgt in der Benutzeroberfläche der App – Dateien müssen nicht manuell bearbeitet werden.
- Öffnen Sie Settings und geben Sie in der Suche
inference endpointein – Warp springt zum Block mit den Anbieter-Schlüsseln und den eigenen Endpoints (er befindet sich auf der Einstellungsseite des Warp Agents). - Klicken Sie auf Add custom endpoint – ein Formular öffnet sich.
- Füllen Sie die Felder mit den Werten aus der Tabelle und klicken Sie auf Add endpoint.
| Formularfeld | Was einzutragen ist | Erklärung |
|---|---|---|
| API schema | OpenAI Chat Completions | Das Standardschema: genau für dieses beschreibt die Warp-Dokumentation das Format der Adresse. In der Liste stehen auch OpenAI Responses und Anthropic Messages |
| Endpoint name | JoinGonka | Beliebiger Name – darunter ist der Endpoint in den Einstellungen sichtbar |
| Endpoint URL | https://gate.joingonka.ai/v1 | Basisadresse inklusive /v1 – genau wie im Beispiel aus der Warp-Dokumentation |
| API key | jg-your-key | Wird nur auf dem Gerät im systemeigenen Schlüsselspeicher abgelegt |
| Model name | deepseek-ai/DeepSeek-V4-Flash-0731 | Die exakte Modell-ID, wie sie das Gateway ausgibt |
| Model alias (optional) | DeepSeek V4 Flash | Kurzname für den Modellumschalter |
Die Schaltfläche + Add model fügt eine weitere Zeile hinzu. Legen Sie gleich alle Modelle des Netzwerks an, um später zwischen ihnen wechseln zu können, ohne in die Einstellungen zurückzukehren: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 und zai-org/GLM-5.3-Flash. Die aktuelle Liste liefert immer GET https://gate.joingonka.ai/v1/models. Tragen Sie die IDs Zeichen für Zeichen ein: Das Formular prüft nur die Form der Adresse und ob alle Felder ausgefüllt sind, einen Testaufruf beim Speichern macht es nicht – ein Tippfehler im Modellnamen fällt also erst im Dialog mit dem Agenten auf.
Nach dem Speichern erscheinen die Modelle im Modellumschalter des Agenten. Falls als Standardmodell eines der Warp-Modelle eingestellt war, kann die App von sich aus vorschlagen, es zu wechseln – stimmen Sie zu und wählen Sie das Modell Ihres Endpoints. Ein wichtiges Detail: Die Optionen Auto im Umschalter laufen immer auf der Infrastruktur von Warp und verbrauchen dessen Credits, selbst wenn ein eigener Endpoint eingerichtet ist. Damit eine Anfrage an das Gateway geht, muss im Umschalter ein konkretes Modell aus Ihrer Liste ausgewählt sein.
Überprüfung: Werden die Anfragen über das Gateway geleitet?
Wählen Sie im Umschalter das Modell Ihres Endpoints und geben Sie dem Agenten eine kurze Aufgabe, zum Beispiel: „Zeige die fünf größten Dateien im aktuellen Verzeichnis und erkläre den Befehl.“ Der Agent soll einen Befehl vorschlagen, ihn nach Ihrer Freigabe ausführen und die Ausgabe kommentieren.
Öffnen Sie nun das Gateway-Panel, Bereich „Nutzung“. Im Block „Nach Schlüsseln“ erscheinen beim für Warp angelegten Schlüssel die Anfragen und der Zeitpunkt des letzten Zugriffs, im Block „Nach Modellen“ das gewählte Modell. Die Zähler steigen – das heißt, die Inference läuft über das JoinGonka Gateway und nicht über Warp-Credits. Warp seinerseits zeigt den Token-Verbrauch direkt im Dialog mit dem Agenten an – unter den kurzen Namen, die Sie im Feld alias vergeben haben.
Ist etwas schiefgelaufen, lässt sich die Ursache meist an der Antwort ablesen:
| Was zu sehen ist | Was das bedeutet | Was zu tun ist |
|---|---|---|
401, Invalid API key | Das Gateway hat den Schlüssel nicht erkannt | Prüfen Sie, ob der Schlüssel mit jg- beginnt, ohne Leerzeichen eingefügt und im Bereich „API-Schlüssel“ aktiv ist; legen Sie im Zweifel einen neuen an |
404, Invalid URL (POST …) | Der Pfad enthält ein überzähliges Segment; im Fehlertext zeigt das Gateway, wo genau die Anfrage angekommen ist | Es muss /v1/chat/completions herauskommen. Hat sich /v1 verdoppelt oder ist der vollständige Pfad in die Adresse geraten – bringen Sie die Endpoint URL auf die Form aus der Tabelle oben |
405 Not Allowed oder eine HTML-Seite statt einer Antwort | In der Adresse fehlt /v1, die Anfrage ging an der API vorbei | Ergänzen Sie /v1 am Ende der Adresse |
429 | Das Modell ist überlastet: zur Stoßzeit ist die Kapazität eines bestimmten Modells im Netz manchmal vollständig ausgeschöpft | Wiederholen Sie es nach ein paar Sekunden oder wechseln Sie zu einem benachbarten Modell – dafür lohnt es sich, gleich alle anzulegen |
| Anfragen laufen durch, aber die Warp-Credits schmelzen dahin | Im Umschalter ist Auto oder der Modell-Router von Warp gewählt, nicht das Modell des Endpoints | Wählen Sie ein konkretes Modell aus Ihrer Liste |
| Das Formular nimmt die Adresse nicht an | Warp verlangt https:// und einen öffentlichen Host | Tragen Sie die Gateway-Adresse vollständig ein, beginnend mit https:// |
| Das Modell „sieht“ das angehängte Bild nicht | Die Modelle des Netzes sind Textmodelle: Das Gateway ersetzt das Bild durch eine Textmarkierung | Wechseln Sie für Aufgaben mit Screenshots zu einem Modell mit Vision, für Befehle und Code bleiben Sie beim Modell des Netzes |
| Das Modell des Endpoints fehlt beim Cloud-Start | Ein eigener Endpoint wird lokal gespeichert und gilt nicht für Cloud Agents | Starten Sie die Aufgabe mit einem lokalen Agenten |
Die erste Antwort in einer Sitzung kann sich um einige Sekunden verzögern: Der Agent sendet einen großen System-Prompt mit der Beschreibung der Tools, und die Anfrage läuft zuerst über die Server von Warp und dann über einen Knoten des Netzes. Danach geht der Dialog schneller.
Welches Modell sollte für den Terminal-Agenten gewählt werden?
Der Preis für die Netzmodelle ist gleich, daher geht es bei der Auswahl um das Verhalten, nicht um das Budget. Der Terminal-Agent liest viel (Befehlsausgaben, Logs, Dateien) und ruft ständig Tools auf; alle Modelle in der Tabelle unterstützen natives Tool Calling.
| Modell | Identifikator | Kontext und Antwort | Wann in Warp nutzen |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K, Antwort bis 32768 Token | Standardmodell für den Agenten: lange Sitzungen, große Logs und Diffs, Änderungen in mehreren Dateien. Kontext-Puffer und das größte Antwort-Limit im Netz |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K, Antwort bis 8192 Token | Schnelle Kurzaufgaben: Befehl finden, Fehler analysieren, Konfiguration anpassen |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K, Antwort bis 8192 Token | Reasoning-Modell: überlegt vor der Antwort. Komplexes Debugging, Migrationsplan, Analyse von unbekanntem Code; die Antwort kommt später und ein Teil des Antwort-Limits fließt in die Überlegungen |
Praktisches Schema: DeepSeek V4 Flash — Hauptmodell, MiniMax M2.7 — für Kleinigkeiten, GLM-5.3 Flash — wenn die Aufgabe an der Logik und nicht am Volumen scheitert. Das Umschalten dauert eine Sekunde, da alle Modelle bereits im Endpoint hinterlegt sind und kurze Namen aus dem Alias-Feld Verwirrung bei langen Identifikatoren vermeiden. Mehr zum beliebtesten Modell finden Sie in der Übersicht zu DeepSeek V4 Flash.
Was das kostet
Der Token-Verbrauch beim Agenten im Terminal ist höher als beim Chat: Warp fügt jeder Anfrage Systemanweisungen, den Dialogkontext und die Tool-Beschreibungen hinzu, und eine Aufgabe besteht aus mehreren Schritten. Daher ist der Preis pro Token hier wichtiger als im gewöhnlichen Austausch.
Über das JoinGonka Gateway kosten Token $0.0069 pro Million bei der Eingabe und $0.021 pro Million bei der Ausgabe — der Preis ist für alle Netzmodelle gleich und wird auf dieser Seite aus einer Live-Quelle übernommen. Größenordnung der Preise für September 2026:
| Szenario | Verbrauch | Über Gateway |
|---|---|---|
| Einzelaufgabe: Befehl und Analyse der Ausgabe | zehntausende Token | Bruchteile eines Cents |
| Tag aktiver Arbeit mit dem Agenten | 3-7M Token | einige Cents |
| Monat täglicher Arbeit | ~150M Token | etwa ein bis zwei Dollar |
Zum Vergleich — drei Möglichkeiten, den Warp-Agenten zu bezahlen:
| Methode | Wer berechnet die Inferenz | Was schränkt ein |
|---|---|---|
| Warp-Modelle | Warp, über Tarif-Credits | Monatlicher Kreditvorrat des Plans |
| BYOK: OpenAI, Anthropic oder Google Schlüssel | Modellanbieter gemäß eigener Preisliste | Preis pro Million Token beim Anbieter |
| Eigener Endpoint + JoinGonka Gateway | Gateway: nach Token, vom Guthaben | Nur das Guthaben: Verbrauch ist im Dashboard sichtbar, keine Quoten auf Anfragen |
Warp selbst erhebt für Einzelpersonen und Teams bis zu 10 Personen keine Credits für die Arbeit über den eigenen Endpoint — Sie zahlen nur für die Token am Gateway. Das Guthaben wird im Dashboard aufgeladen, dort sind auch der Restbetrag sowie der Verbrauch nach Tagen und Modellen sichtbar.
Anfrageroute und Datenschutz: Was wichtig zu wissen ist
Bei den meisten Tools bedeutet ein eigener Endpoint: „Anfragen gehen direkt von meinem Rechner zum Provider“. Bei Warp ist das anders: Der ausführende Teil des Agenten läuft auf Warp-Servern, und ein eigener Endpoint ändert lediglich den Zieladressaten und den Schlüssel. Laut der Warp-Dokumentation sieht der Pfad der Anfrage so aus:
- Die App nimmt die Endpoint-Adresse und den Schlüssel aus dem geschützten Speicher des Geräts und sendet sie zusammen mit Ihrem Prompt an die Warp-Server.
- Der Agent auf der Warp-Seite baut die vollständige Anfrage zusammen — Systemanweisungen, Dialogkontext, Tools — und ruft Ihren Endpoint mit diesem Schlüssel auf.
- Die Antwort wird über dieselben Server als Stream an die App zurückgegeben.
Was bedeutet das in der Praxis:
- Schlüssel. Er wird nur auf dem Gerät gespeichert. Er läuft bei jeder Anfrage über die Warp-Server, wird aber laut Warp dort nicht gespeichert: Er wird „on the fly“ verwendet und danach verworfen.
- Prompts und Antworten. Diese werden über das Warp-Backend weitergeleitet. Warp gibt an, diese Inhalte nicht für das Training zu verwenden; Speicherung und Analysen unterliegen den Datenschutz- und Telemetrieeinstellungen Ihres Kontos. Die ZDR-Garantie, die für die Modelle von Warp selbst gilt, kann nicht auf Ihren eigenen Endpoint übertragen werden: Was der Provider speichert, bestimmt der Provider.
- Gateway-Seite. Das JoinGonka Gateway speichert keine Dialoge: Prompts und Antworten verbleiben nicht auf dem Gateway, nachdem die Antwort erfolgt ist; im Dashboard sind nur Anfrage- und Token-Zähler sichtbar.
- Was auf der Warp-Infrastruktur verbleibt. Die Optionen Auto, benutzerdefinierte Modell-Router, Codebase Context, Active AI-Vorschläge und Cloud-Agenten — darauf hat ein eigener Endpoint keinen Einfluss.
Wenn der Weg über fremde Server für Ihre Anforderungen nicht akzeptabel ist, nutzen Sie einen Agenten, der direkt von Ihrem Rechner aus auf den Endpoint zugreift — zum Beispiel Codex CLI oder jedes Tool aus dem API-Schnellstart. Warp selbst verspricht in der Ankündigung auch eine clientseitige Variante: ein leichtgewichtiges Agenten-Modul in Rust in einem Open-Source-Repository, das eine Verbindung zu lokalen Modellen ohne Routing über Warp-Server herstellt, sowie Unterstützung für das Agent Client Protocol. Seit der Version vom 2. September 2026 werden die Endpoint-Beschreibungen in einer Konfigurationsdatei gespeichert, die für die Anwendung und den Warp Agent CLI gemeinsam genutzt wird; die Schlüssel gelangen nicht in diese Datei und verbleiben im geschützten Speicher.
Möchten Sie mehr erfahren?
Erkunden Sie andere Abschnitte oder beginnen Sie jetzt GNK zu verdienen.
Schlüssel und kostenlose Token erhalten →