Sections de la base de connaissances ▾

Navigation

▸ Commencez ici Par rôles

Catégories

Outils 52
Glossaire 12

Outils

Warp + JoinGonka Gateway — agent de terminal sur votre propre endpoint

Warp est un terminal qui a évolué vers un environnement de développement par agents : l'agent Warp intégré lit la sortie des commandes, modifie les fichiers, lance des builds et gère les tâches de la requête au résultat. Par défaut, l'agent utilise les modèles vendus par Warp — en utilisant les crédits du forfait — et il a longtemps été impossible d'apporter son propre inference sans payer un plan premium avec une clé OpenAI, Anthropic ou Google. Le 20 mai 2026, Warp a ouvert le BYOK sur le forfait gratuit et a ajouté un custom inference endpoint — permettant de connecter n'importe quel service compatible avec OpenAI Chat Completions.

Cette seconde méthode est nécessaire pour faire passer l'agent Warp via la JoinGonka Gateway : la passerelle fournit des modèles du réseau décentralisé Gonka via une API compatible OpenAI, l'inference est payée au prix du réseau, et les développeurs solo ou les petites équipes ne consomment pas leurs crédits Warp pour cela. Après l'inscription et la confirmation de votre adresse, vous recevrez 3M de jetons gratuits sur votre compte — assez pour tester l'agent sur vos propres tâches avant le premier rechargement.

Ci-dessous, vous trouverez ce qui est nécessaire avant de commencer, les valeurs à saisir dans le formulaire Warp, comment vérifier que les requêtes passent par la passerelle, quel modèle réseau choisir pour les tâches de terminal et ce qu'il faut savoir sur le routage des requêtes : celui de Warp fonctionne différemment de la plupart des autres outils.

Ce dont vous aurez besoin : clé, forfait Warp et adresse publique

Clé JoinGonka. Inscrivez-vous sur la passerelle, ouvrez la section « Clés API » dans votre tableau de bord et cliquez sur « Créer une clé ». La clé commence par jg- et ne s'affiche qu'une seule fois — enregistrez-la immédiatement. Il est pratique de créer une clé dédiée pour Warp : ainsi, dans la section « Utilisation », la consommation de l'agent de terminal sera visible sur une ligne distincte, sans être mélangée aux autres outils.

Forfait Warp. Votre propre endpoint n'est pas limité aux plans payants — les conditions dépendent de la taille de l'équipe :

Qui se connecteEndpoint personnalisé disponibleQu'en est-il des crédits Warp ?
Développeur solo ou équipe jusqu'à 10 personnes (plans Free, Build, Max)Oui, sur n'importe lequel de ces plansAucun crédit n'est déduit pour l'inference via votre endpoint
Organisation de plus de 10 personnesBusiness ou Enterprise uniquementLes exécutions locales de l'agent consomment des platform credits — frais d'infrastructure Warp à tarif réduit ; l'inference elle-même est payée au fournisseur d'endpoint

Adresse HTTPS publique. C'est une exigence de Warp à laquelle on ne pense pas forcément : les requêtes vers votre endpoint ne sont pas envoyées par l'application sur votre machine, mais par les serveurs de Warp, donc l'adresse doit être accessible depuis Internet. localhost, 127.0.0.1 et les adresses privées sont rejetés par le formulaire, et seul le schéma https:// est autorisé. JoinGonka Gateway est un service HTTPS public, donc les tunnels comme ngrok, recommandés par la documentation Warp pour les modèles locaux, ne sont pas nécessaires ici.

Version récente de l'application. Votre propre endpoint est inclus dans la version stable depuis le 20 mai 2026, et le choix du schéma API dans le formulaire est apparu le 31 juillet 2026. Si le champ API schema est absent, mettez à jour Warp.

Connexion : formulaire Add custom endpoint

Toute la configuration se fait dans l'interface de l'application — inutile de modifier les fichiers à la main.

  1. Ouvrez Settings et tapez inference endpoint dans la recherche des paramètres — Warp vous amènera au bloc contenant les clés des fournisseurs et vos propres endpoint (il se trouve sur la page de paramètres de Warp Agent).
  2. Cliquez sur Add custom endpoint — un formulaire s'ouvre.
  3. Remplissez les champs avec les valeurs du tableau et cliquez sur Add endpoint.
Champ du formulaireQuoi saisirExplication
API schemaOpenAI Chat CompletionsSchéma par défaut : c'est pour celui-ci que la documentation de Warp décrit le format de l'adresse. La liste propose aussi OpenAI Responses et Anthropic Messages
Endpoint nameJoinGonkaN'importe quel nom — c'est sous celui-ci que l'endpoint apparaît dans les paramètres
Endpoint URLhttps://gate.joingonka.ai/v1L'adresse de base avec /v1 — exactement comme dans l'exemple de la documentation de Warp
API keyjg-your-keyStockée uniquement sur l'appareil, dans le trousseau de clés du système
Model namedeepseek-ai/DeepSeek-V4-Flash-0731L'identifiant exact du modèle, tel que le renvoie la passerelle
Model alias (optional)DeepSeek V4 FlashUn nom court pour le sélecteur de modèles

Le bouton + Add model ajoute une ligne supplémentaire. Enregistrez d'emblée tous les modèles du réseau pour pouvoir basculer entre eux ensuite sans revenir dans les paramètres : deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 et zai-org/GLM-5.3-Flash. La liste à jour est toujours renvoyée par GET https://gate.joingonka.ai/v1/models. Saisissez les identifiants caractère par caractère : le formulaire ne vérifie que l'allure de l'adresse et le remplissage des champs, il n'effectue aucune requête d'essai à l'enregistrement, si bien qu'une faute de frappe dans le nom du modèle ne se manifestera que dans le dialogue avec l'agent.

Une fois enregistrés, les modèles apparaissent dans le sélecteur de modèles de l'agent. Si l'un des modèles Warp restait défini par défaut, l'application peut elle-même proposer de le changer — acceptez et choisissez le modèle de votre endpoint. Un détail important : les options Auto du sélecteur fonctionnent toujours sur l'infrastructure de Warp et consomment ses crédits, même lorsqu'un endpoint personnel est configuré. Pour que la requête parte vers la passerelle, il faut qu'un modèle précis de votre liste soit sélectionné dans le sélecteur.

Vérification : les requêtes passent-elles par la passerelle ?

Dans le sélecteur, choisissez le modèle de votre endpoint et confiez à l'agent une tâche courte, par exemple : « Affiche les cinq plus gros fichiers du répertoire courant et explique la commande ». L'agent doit proposer une commande, l'exécuter avec votre autorisation et commenter le résultat.

Ouvrez maintenant la console de la passerelle, section « Utilisation ». Dans le bloc « Par clés », la clé créée pour Warp affichera les requêtes et l'heure du dernier appel ; dans le bloc « Par modèles », le modèle sélectionné. Si les compteurs grimpent, c'est que l'inférence passe par JoinGonka Gateway et non par les crédits Warp. De son côté, Warp affiche la consommation de tokens directement dans le dialogue avec l'agent, sous les noms courts que vous avez définis dans le champ alias.

En cas de problème, la réponse indique généralement la cause :

Ce que vous voyezCe que cela signifieQue faire
401, Invalid API keyLa passerelle n'a pas reconnu la cléVérifiez que la clé commence par jg-, qu'elle est collée sans espaces et active dans la section « Clés API » ; en cas de doute, créez-en une nouvelle
404, Invalid URL (POST …)Le chemin comporte un segment en trop ; le message d'erreur indique où la requête a atterriLe résultat doit être /v1/chat/completions. Si /v1 est doublé ou si l'adresse contient le chemin complet, ramenez l'Endpoint URL à la forme indiquée dans le tableau ci-dessus
405 Not Allowed ou une page HTML à la place de la réponseIl manque /v1 dans l'adresse, la requête est passée à côté de l'APIAjoutez /v1 à la fin de l'adresse
429Modèle surchargé : aux heures de pointe, la capacité d'un modèle donné sur le réseau peut être entièrement saturéeRéessayez dans quelques secondes ou basculez sur un modèle voisin — c'est justement pourquoi il vaut mieux les configurer tous d'un coup
Les requêtes passent, mais les crédits Warp fondentLe sélecteur est sur Auto ou sur le routeur de modèles Warp, et non sur le modèle de l'endpointChoisissez un modèle précis dans votre liste
Le formulaire refuse l'adresseWarp exige https:// et un hôte publicSaisissez l'adresse complète de la passerelle, en commençant par https://
Le modèle « ne voit pas » l'image jointeLes modèles du réseau sont textuels : la passerelle remplace l'image par une annotation textuellePour les tâches avec captures d'écran, basculez sur un modèle doté de la vision ; pour les commandes et le code, restez sur le modèle du réseau
Le modèle de l'endpoint est absent en exécution cloudVotre endpoint est stocké en local et ne s'applique pas aux Cloud AgentsLancez la tâche avec un agent local

La première réponse de la session peut prendre quelques secondes : l'agent envoie un long prompt système décrivant les outils, et la requête traverse d'abord les serveurs Warp puis un nœud du réseau. Ensuite, le dialogue s'accélère.

Quel modèle choisir pour l'agent de terminal

Le prix des modèles du réseau est identique, le choix dépend donc du comportement et non du budget. L'agent terminal lit beaucoup (sortie de commandes, logs, fichiers) et appelle constamment des outils ; tous les modèles du tableau prennent en charge le tool calling natif.

ModèleIdentifiantContexte et réponseQuand l'utiliser dans Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, réponse jusqu'à 32768 tokensModèle par défaut pour l'agent : sessions longues, grands logs et diffs, modifications dans plusieurs fichiers. Réserve de contexte importante et le plus grand plafond de réponse du réseau
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, réponse jusqu'à 8192 tokensTâches courtes et rapides : trouver une commande, analyser une erreur, corriger une configuration
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, réponse jusqu'à 8192 tokensModèle de raisonnement : réfléchit avant de répondre. Débogage complexe, plan de migration, analyse de code inconnu ; la réponse arrive plus tard et une partie de la limite de réponse est consacrée au raisonnement

Schéma pratique : DeepSeek V4 Flash est le modèle principal, MiniMax M2.7 pour les petites tâches, GLM-5.3 Flash lorsque la tâche nécessite de la logique plutôt que du volume. Le basculement ne prend qu'une seconde car tous les modèles sont déjà configurés dans l'endpoint, et les noms courts du champ alias permettent d'éviter toute confusion avec les identifiants longs. Plus de détails sur le plus populaire d'entre eux dans la présentation de DeepSeek V4 Flash.

Combien cela coûte

La consommation de tokens de l'agent dans le terminal est plus élevée que dans un chat : à chaque requête, Warp ajoute des instructions système, le contexte du dialogue et la description des outils, et une tâche se compose de plusieurs étapes. C'est pourquoi le prix par token est plus déterminant ici que dans une correspondance classique.

Via JoinGonka Gateway, les tokens coûtent $0.0069 par million en entrée et $0.021 par million en sortie — le prix est identique pour tous les modèles du réseau et est récupéré sur cette page à partir d'une source en temps réel. Ordre de grandeur des prix pour septembre 2026 :

ScénarioConsommationVia Gateway
Tâche unique : commande et analyse de sa sortiedizaines de milliers de tokensfractions de cent
Journée de travail actif avec l'agent3-7M tokensquelques cents
Mois de travail quotidien~150M tokensenviron un ou deux dollars

Pour comparer, voici trois manières de payer l'agent Warp :

MéthodeQui facture l'inférenceCe qui limite
Modèles WarpWarp, avec les crédits du forfaitRéserve mensuelle de crédits du plan
BYOK : clé OpenAI, Anthropic ou GoogleFournisseur du modèle selon son tarifPrix par million de tokens du fournisseur
Votre endpoint + JoinGonka GatewayPasserelle : selon les tokens, depuis le soldeSolde uniquement : consommation visible dans l'espace client, aucune limite sur le nombre de requêtes

Warp lui-même ne facture pas de crédits pour une utilisation individuelle ou pour les équipes jusqu'à 10 personnes travaillant via leur propre endpoint — vous ne payez que les tokens sur la passerelle. Le solde est rechargé dans l'espace client, où vous pouvez également consulter le solde restant et la consommation par jour et par modèle.

Flux des requêtes et confidentialité : ce qu'il est important de savoir

Pour la plupart des outils, un endpoint personnalisé signifie que « les requêtes partent de ma machine directement vers le fournisseur ». Avec Warp, c'est différent : la partie exécution de l'agent fonctionne sur les serveurs Warp, et le endpoint personnalisé modifie uniquement le destinataire final et la clé. Selon la documentation de Warp, le chemin de la requête est le suivant :

  1. L'application récupère l'adresse du endpoint et la clé dans le stockage sécurisé de l'appareil et les envoie aux serveurs Warp avec votre prompt.
  2. L'agent côté Warp assemble la requête complète — instructions système, contexte de dialogue, outils — et appelle votre endpoint avec cette clé.
  3. La réponse est renvoyée à l'application par flux via les mêmes serveurs.

Ce qu'il faut en retenir en pratique :

  • Clé. Stockée uniquement sur l'appareil. Elle transite par les serveurs Warp à chaque requête, mais, selon Warp, elle n'y est pas conservée : elle est utilisée à la volée puis supprimée.
  • Prompts et réponses. Ils transitent par le backend de Warp. Warp déclare ne pas utiliser ce contenu pour l'entraînement, et le stockage ainsi que l'analyse sont soumis aux paramètres de confidentialité et de télémétrie de votre compte. La garantie ZDR, qui s'applique aux modèles de Warp, ne peut pas être étendue à votre propre endpoint : ce que le fournisseur stocke est déterminé par le fournisseur lui-même.
  • Côté passerelle. JoinGonka Gateway ne conserve pas les dialogues : les prompts et les réponses ne restent pas sur la passerelle après la réponse ; seuls les compteurs de requêtes et de jetons sont visibles dans l'espace client.
  • Ce qui reste sur l'infrastructure Warp. Les options Auto, les routeurs de modèles personnalisés, Codebase Context, les suggestions Active AI et les agents cloud — le endpoint personnalisé n'a aucun impact sur ceux-ci.

Si, pour vos besoins, le passage par des serveurs tiers est inacceptable, utilisez un agent qui accède au endpoint directement depuis votre machine — par exemple, Codex CLI ou tout autre outil du guide de démarrage rapide API. Warp promet lui-même dans son annonce une variante client : un module d'agent léger en Rust dans un dépôt open source, qui se connectera aux modèles locaux sans passer par les serveurs Warp, ainsi qu'un support du protocole Agent Client Protocol. Depuis la version du 2 septembre 2026, les descriptions des endpoints sont stockées dans un fichier de configuration au format commun pour l'application et Warp Agent CLI ; les clés ne sont pas incluses dans ce fichier et restent dans le stockage sécurisé.

Warp se connecte à JoinGonka Gateway via le formulaire Add custom endpoint : schéma OpenAI Chat Completions, adresse https://gate.joingonka.ai/v1, clé jg- et identifiants des modèles du réseau. Pour les utilisateurs individuels et les équipes jusqu'à 10 personnes, cela est disponible même sur le forfait gratuit, et les crédits Warp ne sont pas consommés pour l'inférence si le modèle endpoint est sélectionné dans le sélecteur au lieu de Auto. La principale caractéristique de Warp est son itinéraire : les requêtes vers l'endpoint sont envoyées par ses serveurs, l'adresse doit donc être publique et les prompts transitent par le backend de Warp. Pour les tâches de terminal, utilisez DeepSeek V4 Flash, pour les petites tâches, MiniMax M2.7, et pour une logique complexe, GLM-5.3 Flash.

Vous voulez en savoir plus ?

Explorez d'autres sections ou commencez à gagner des GNK dès maintenant.

Obtenir une clé et des jetons gratuits →