Sections de la base de connaissances ▾
Navigation
▸ Commencez ici Par rôlesCatégories
- Cursor + Gonka AI — LLM pas cher pour le codage
- Claude Code + Gonka AI — LLM pour le terminal
- OpenClaw + Gonka AI — Agents IA accessibles
- OpenCode : votre propre modèle dans le terminal
- Continue.dev + Gonka AI — IA pour VS Code/JetBrains
- Cline + Gonka AI — Agent IA dans VS Code
- Aider + Gonka AI — programmation en binôme avec l'IA
- LangChain + Gonka AI — Applications IA pour des centimes
- n8n + Gonka AI — Automatisation avec IA pas chère
- Open WebUI + Gonka AI — Votre propre ChatGPT
- LibreChat + Gonka AI — ChatGPT open-source
- Hermes Agent + DeepSeek sur le réseau Gonka : un agent autonome à petit prix
- Kilo Code + Gonka AI — Agent IA dans VS Code
- Roo Code + Gonka AI — Agent IA autonome dans VS Code
- LlamaIndex + Gonka AI — Applications RAG pour une bouchée de pain
- PydanticAI + Gonka — Agents IA typés pour une bouchée de pain
- Vercel AI SDK + Gonka AI — Applications IA en TypeScript pour une bouchée de pain
- TanStack AI + Gonka — Applications IA en TypeScript pour une bouchée de pain
- API démarrage rapide — curl, Python, TypeScript
- JoinGonka Gateway — présentation complète
- Management Keys — SaaS sur Gonka
- L'API AI la moins chère : comparaison des fournisseurs 2026
- Comment acheter des tokens AI et une clé API : 3 méthodes en 2026
- Limite de requêtes Cursor Pro atteinte — analyse et alternative économique
- Claude Code moins cher — analyse de facture et changement
- Cline brûle votre argent — pourquoi l'agent consomme autant
- OpenClaw coûte cher — pourquoi l'agent consomme des tokens et comment économiser
- OpenRouter : une alternative bon marché — comparaison avec JoinGonka Gateway
- Meilleur modèle AI pour le codage en 2026 : comparaison et tarifs
- Alternative bon marché à GitHub Copilot sans limites
- Alternative bon marché à Windsurf sans crédits ni limites
- L'API la moins chère pour les agents AI en 2026
- ZCode : inférence GLM abordable au lieu du GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — votre endpoint au lieu des crédits
- GitHub Copilot BYOK — vos modèles plutôt que vos quotas
- Zed + JoinGonka Gateway — inférence bon marché dans l'éditeur
- Pi + JoinGonka Gateway — agent de terminal sur inférence à bas prix
- Codex CLI : utilisez votre propre clé plutôt qu'un abonnement
- DeepSeek Harness : votre propre fournisseur via JoinGonka Gateway
- MiniMax Code : agent MiniMax avec votre clé via Gonka
- Warp + JoinGonka Gateway — agent de terminal sur votre propre endpoint
- Trae + JoinGonka Gateway — modèles du réseau Gonka dans AI-IDE
- Cherry Studio + JoinGonka Gateway — client AI de bureau
- omp (Oh My Pi) + JoinGonka Gateway : agent avec rôles de modèles
- OpenHands + JoinGonka Gateway : agent sur votre propre endpoint
- Qwen Code après la fermeture de qwen-oauth : fonctionnement via JoinGonka Gateway
- Goose + JoinGonka Gateway : votre propre fournisseur et clé dans le trousseau
- Crush + JoinGonka Gateway : agent Charm sur les modèles du réseau Gonka
- Zoo Code + JoinGonka Gateway : migrer de Roo Code vers les modèles Gonka
- Kimi Code CLI : agent Moonshot AI sur votre clé via Gonka
- Factory Droid + JoinGonka Gateway : BYOK sur les modèles du réseau Gonka
- MiMo Code + JoinGonka Gateway : agent Xiaomi sur les modèles du réseau Gonka
Outils
Warp + JoinGonka Gateway — agent de terminal sur votre propre endpoint
Warp est un terminal qui a évolué vers un environnement de développement par agents : l'agent Warp intégré lit la sortie des commandes, modifie les fichiers, lance des builds et gère les tâches de la requête au résultat. Par défaut, l'agent utilise les modèles vendus par Warp — en utilisant les crédits du forfait — et il a longtemps été impossible d'apporter son propre inference sans payer un plan premium avec une clé OpenAI, Anthropic ou Google. Le 20 mai 2026, Warp a ouvert le BYOK sur le forfait gratuit et a ajouté un custom inference endpoint — permettant de connecter n'importe quel service compatible avec OpenAI Chat Completions.
Cette seconde méthode est nécessaire pour faire passer l'agent Warp via la JoinGonka Gateway : la passerelle fournit des modèles du réseau décentralisé Gonka via une API compatible OpenAI, l'inference est payée au prix du réseau, et les développeurs solo ou les petites équipes ne consomment pas leurs crédits Warp pour cela. Après l'inscription et la confirmation de votre adresse, vous recevrez 3M de jetons gratuits sur votre compte — assez pour tester l'agent sur vos propres tâches avant le premier rechargement.
Ci-dessous, vous trouverez ce qui est nécessaire avant de commencer, les valeurs à saisir dans le formulaire Warp, comment vérifier que les requêtes passent par la passerelle, quel modèle réseau choisir pour les tâches de terminal et ce qu'il faut savoir sur le routage des requêtes : celui de Warp fonctionne différemment de la plupart des autres outils.
Ce dont vous aurez besoin : clé, forfait Warp et adresse publique
Clé JoinGonka. Inscrivez-vous sur la passerelle, ouvrez la section « Clés API » dans votre tableau de bord et cliquez sur « Créer une clé ». La clé commence par jg- et ne s'affiche qu'une seule fois — enregistrez-la immédiatement. Il est pratique de créer une clé dédiée pour Warp : ainsi, dans la section « Utilisation », la consommation de l'agent de terminal sera visible sur une ligne distincte, sans être mélangée aux autres outils.
Forfait Warp. Votre propre endpoint n'est pas limité aux plans payants — les conditions dépendent de la taille de l'équipe :
| Qui se connecte | Endpoint personnalisé disponible | Qu'en est-il des crédits Warp ? |
|---|---|---|
| Développeur solo ou équipe jusqu'à 10 personnes (plans Free, Build, Max) | Oui, sur n'importe lequel de ces plans | Aucun crédit n'est déduit pour l'inference via votre endpoint |
| Organisation de plus de 10 personnes | Business ou Enterprise uniquement | Les exécutions locales de l'agent consomment des platform credits — frais d'infrastructure Warp à tarif réduit ; l'inference elle-même est payée au fournisseur d'endpoint |
Adresse HTTPS publique. C'est une exigence de Warp à laquelle on ne pense pas forcément : les requêtes vers votre endpoint ne sont pas envoyées par l'application sur votre machine, mais par les serveurs de Warp, donc l'adresse doit être accessible depuis Internet. localhost, 127.0.0.1 et les adresses privées sont rejetés par le formulaire, et seul le schéma https:// est autorisé. JoinGonka Gateway est un service HTTPS public, donc les tunnels comme ngrok, recommandés par la documentation Warp pour les modèles locaux, ne sont pas nécessaires ici.
Version récente de l'application. Votre propre endpoint est inclus dans la version stable depuis le 20 mai 2026, et le choix du schéma API dans le formulaire est apparu le 31 juillet 2026. Si le champ API schema est absent, mettez à jour Warp.
Connexion : formulaire Add custom endpoint
Toute la configuration se fait dans l'interface de l'application — inutile de modifier les fichiers à la main.
- Ouvrez Settings et tapez
inference endpointdans la recherche des paramètres — Warp vous amènera au bloc contenant les clés des fournisseurs et vos propres endpoint (il se trouve sur la page de paramètres de Warp Agent). - Cliquez sur Add custom endpoint — un formulaire s'ouvre.
- Remplissez les champs avec les valeurs du tableau et cliquez sur Add endpoint.
| Champ du formulaire | Quoi saisir | Explication |
|---|---|---|
| API schema | OpenAI Chat Completions | Schéma par défaut : c'est pour celui-ci que la documentation de Warp décrit le format de l'adresse. La liste propose aussi OpenAI Responses et Anthropic Messages |
| Endpoint name | JoinGonka | N'importe quel nom — c'est sous celui-ci que l'endpoint apparaît dans les paramètres |
| Endpoint URL | https://gate.joingonka.ai/v1 | L'adresse de base avec /v1 — exactement comme dans l'exemple de la documentation de Warp |
| API key | jg-your-key | Stockée uniquement sur l'appareil, dans le trousseau de clés du système |
| Model name | deepseek-ai/DeepSeek-V4-Flash-0731 | L'identifiant exact du modèle, tel que le renvoie la passerelle |
| Model alias (optional) | DeepSeek V4 Flash | Un nom court pour le sélecteur de modèles |
Le bouton + Add model ajoute une ligne supplémentaire. Enregistrez d'emblée tous les modèles du réseau pour pouvoir basculer entre eux ensuite sans revenir dans les paramètres : deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 et zai-org/GLM-5.3-Flash. La liste à jour est toujours renvoyée par GET https://gate.joingonka.ai/v1/models. Saisissez les identifiants caractère par caractère : le formulaire ne vérifie que l'allure de l'adresse et le remplissage des champs, il n'effectue aucune requête d'essai à l'enregistrement, si bien qu'une faute de frappe dans le nom du modèle ne se manifestera que dans le dialogue avec l'agent.
Une fois enregistrés, les modèles apparaissent dans le sélecteur de modèles de l'agent. Si l'un des modèles Warp restait défini par défaut, l'application peut elle-même proposer de le changer — acceptez et choisissez le modèle de votre endpoint. Un détail important : les options Auto du sélecteur fonctionnent toujours sur l'infrastructure de Warp et consomment ses crédits, même lorsqu'un endpoint personnel est configuré. Pour que la requête parte vers la passerelle, il faut qu'un modèle précis de votre liste soit sélectionné dans le sélecteur.
Vérification : les requêtes passent-elles par la passerelle ?
Dans le sélecteur, choisissez le modèle de votre endpoint et confiez à l'agent une tâche courte, par exemple : « Affiche les cinq plus gros fichiers du répertoire courant et explique la commande ». L'agent doit proposer une commande, l'exécuter avec votre autorisation et commenter le résultat.
Ouvrez maintenant la console de la passerelle, section « Utilisation ». Dans le bloc « Par clés », la clé créée pour Warp affichera les requêtes et l'heure du dernier appel ; dans le bloc « Par modèles », le modèle sélectionné. Si les compteurs grimpent, c'est que l'inférence passe par JoinGonka Gateway et non par les crédits Warp. De son côté, Warp affiche la consommation de tokens directement dans le dialogue avec l'agent, sous les noms courts que vous avez définis dans le champ alias.
En cas de problème, la réponse indique généralement la cause :
| Ce que vous voyez | Ce que cela signifie | Que faire |
|---|---|---|
401, Invalid API key | La passerelle n'a pas reconnu la clé | Vérifiez que la clé commence par jg-, qu'elle est collée sans espaces et active dans la section « Clés API » ; en cas de doute, créez-en une nouvelle |
404, Invalid URL (POST …) | Le chemin comporte un segment en trop ; le message d'erreur indique où la requête a atterri | Le résultat doit être /v1/chat/completions. Si /v1 est doublé ou si l'adresse contient le chemin complet, ramenez l'Endpoint URL à la forme indiquée dans le tableau ci-dessus |
405 Not Allowed ou une page HTML à la place de la réponse | Il manque /v1 dans l'adresse, la requête est passée à côté de l'API | Ajoutez /v1 à la fin de l'adresse |
429 | Modèle surchargé : aux heures de pointe, la capacité d'un modèle donné sur le réseau peut être entièrement saturée | Réessayez dans quelques secondes ou basculez sur un modèle voisin — c'est justement pourquoi il vaut mieux les configurer tous d'un coup |
| Les requêtes passent, mais les crédits Warp fondent | Le sélecteur est sur Auto ou sur le routeur de modèles Warp, et non sur le modèle de l'endpoint | Choisissez un modèle précis dans votre liste |
| Le formulaire refuse l'adresse | Warp exige https:// et un hôte public | Saisissez l'adresse complète de la passerelle, en commençant par https:// |
| Le modèle « ne voit pas » l'image jointe | Les modèles du réseau sont textuels : la passerelle remplace l'image par une annotation textuelle | Pour les tâches avec captures d'écran, basculez sur un modèle doté de la vision ; pour les commandes et le code, restez sur le modèle du réseau |
| Le modèle de l'endpoint est absent en exécution cloud | Votre endpoint est stocké en local et ne s'applique pas aux Cloud Agents | Lancez la tâche avec un agent local |
La première réponse de la session peut prendre quelques secondes : l'agent envoie un long prompt système décrivant les outils, et la requête traverse d'abord les serveurs Warp puis un nœud du réseau. Ensuite, le dialogue s'accélère.
Quel modèle choisir pour l'agent de terminal
Le prix des modèles du réseau est identique, le choix dépend donc du comportement et non du budget. L'agent terminal lit beaucoup (sortie de commandes, logs, fichiers) et appelle constamment des outils ; tous les modèles du tableau prennent en charge le tool calling natif.
| Modèle | Identifiant | Contexte et réponse | Quand l'utiliser dans Warp |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K, réponse jusqu'à 32768 tokens | Modèle par défaut pour l'agent : sessions longues, grands logs et diffs, modifications dans plusieurs fichiers. Réserve de contexte importante et le plus grand plafond de réponse du réseau |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K, réponse jusqu'à 8192 tokens | Tâches courtes et rapides : trouver une commande, analyser une erreur, corriger une configuration |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K, réponse jusqu'à 8192 tokens | Modèle de raisonnement : réfléchit avant de répondre. Débogage complexe, plan de migration, analyse de code inconnu ; la réponse arrive plus tard et une partie de la limite de réponse est consacrée au raisonnement |
Schéma pratique : DeepSeek V4 Flash est le modèle principal, MiniMax M2.7 pour les petites tâches, GLM-5.3 Flash lorsque la tâche nécessite de la logique plutôt que du volume. Le basculement ne prend qu'une seconde car tous les modèles sont déjà configurés dans l'endpoint, et les noms courts du champ alias permettent d'éviter toute confusion avec les identifiants longs. Plus de détails sur le plus populaire d'entre eux dans la présentation de DeepSeek V4 Flash.
Combien cela coûte
La consommation de tokens de l'agent dans le terminal est plus élevée que dans un chat : à chaque requête, Warp ajoute des instructions système, le contexte du dialogue et la description des outils, et une tâche se compose de plusieurs étapes. C'est pourquoi le prix par token est plus déterminant ici que dans une correspondance classique.
Via JoinGonka Gateway, les tokens coûtent $0.0069 par million en entrée et $0.021 par million en sortie — le prix est identique pour tous les modèles du réseau et est récupéré sur cette page à partir d'une source en temps réel. Ordre de grandeur des prix pour septembre 2026 :
| Scénario | Consommation | Via Gateway |
|---|---|---|
| Tâche unique : commande et analyse de sa sortie | dizaines de milliers de tokens | fractions de cent |
| Journée de travail actif avec l'agent | 3-7M tokens | quelques cents |
| Mois de travail quotidien | ~150M tokens | environ un ou deux dollars |
Pour comparer, voici trois manières de payer l'agent Warp :
| Méthode | Qui facture l'inférence | Ce qui limite |
|---|---|---|
| Modèles Warp | Warp, avec les crédits du forfait | Réserve mensuelle de crédits du plan |
| BYOK : clé OpenAI, Anthropic ou Google | Fournisseur du modèle selon son tarif | Prix par million de tokens du fournisseur |
| Votre endpoint + JoinGonka Gateway | Passerelle : selon les tokens, depuis le solde | Solde uniquement : consommation visible dans l'espace client, aucune limite sur le nombre de requêtes |
Warp lui-même ne facture pas de crédits pour une utilisation individuelle ou pour les équipes jusqu'à 10 personnes travaillant via leur propre endpoint — vous ne payez que les tokens sur la passerelle. Le solde est rechargé dans l'espace client, où vous pouvez également consulter le solde restant et la consommation par jour et par modèle.
Flux des requêtes et confidentialité : ce qu'il est important de savoir
Pour la plupart des outils, un endpoint personnalisé signifie que « les requêtes partent de ma machine directement vers le fournisseur ». Avec Warp, c'est différent : la partie exécution de l'agent fonctionne sur les serveurs Warp, et le endpoint personnalisé modifie uniquement le destinataire final et la clé. Selon la documentation de Warp, le chemin de la requête est le suivant :
- L'application récupère l'adresse du endpoint et la clé dans le stockage sécurisé de l'appareil et les envoie aux serveurs Warp avec votre prompt.
- L'agent côté Warp assemble la requête complète — instructions système, contexte de dialogue, outils — et appelle votre endpoint avec cette clé.
- La réponse est renvoyée à l'application par flux via les mêmes serveurs.
Ce qu'il faut en retenir en pratique :
- Clé. Stockée uniquement sur l'appareil. Elle transite par les serveurs Warp à chaque requête, mais, selon Warp, elle n'y est pas conservée : elle est utilisée à la volée puis supprimée.
- Prompts et réponses. Ils transitent par le backend de Warp. Warp déclare ne pas utiliser ce contenu pour l'entraînement, et le stockage ainsi que l'analyse sont soumis aux paramètres de confidentialité et de télémétrie de votre compte. La garantie ZDR, qui s'applique aux modèles de Warp, ne peut pas être étendue à votre propre endpoint : ce que le fournisseur stocke est déterminé par le fournisseur lui-même.
- Côté passerelle. JoinGonka Gateway ne conserve pas les dialogues : les prompts et les réponses ne restent pas sur la passerelle après la réponse ; seuls les compteurs de requêtes et de jetons sont visibles dans l'espace client.
- Ce qui reste sur l'infrastructure Warp. Les options Auto, les routeurs de modèles personnalisés, Codebase Context, les suggestions Active AI et les agents cloud — le endpoint personnalisé n'a aucun impact sur ceux-ci.
Si, pour vos besoins, le passage par des serveurs tiers est inacceptable, utilisez un agent qui accède au endpoint directement depuis votre machine — par exemple, Codex CLI ou tout autre outil du guide de démarrage rapide API. Warp promet lui-même dans son annonce une variante client : un module d'agent léger en Rust dans un dépôt open source, qui se connectera aux modèles locaux sans passer par les serveurs Warp, ainsi qu'un support du protocole Agent Client Protocol. Depuis la version du 2 septembre 2026, les descriptions des endpoints sont stockées dans un fichier de configuration au format commun pour l'application et Warp Agent CLI ; les clés ne sont pas incluses dans ce fichier et restent dans le stockage sécurisé.
Vous voulez en savoir plus ?
Explorez d'autres sections ou commencez à gagner des GNK dès maintenant.
Obtenir une clé et des jetons gratuits →