Secciones de la base de conocimientos ▾

Navegación

▸ Empiece aquí Por roles

Categorías

Herramientas 52
Glosario 12

Herramientas

Warp + JoinGonka Gateway: agente de terminal en tu propio endpoint

Warp es una terminal que se ha convertido en un entorno de desarrollo basado en agentes: el Warp Agent integrado lee la salida de los comandos, edita archivos, ejecuta compilaciones y gestiona tareas desde la solicitud hasta el resultado. Por defecto, el agente funciona con modelos vendidos por el mismo Warp a través de créditos, y durante mucho tiempo, traer tu propio modelo solo era posible en planes de pago y mediante claves de OpenAI, Anthropic o Google. El 20 de mayo de 2026, Warp abrió el BYOK en el plan gratuito y añadió custom inference endpoint: la conexión con cualquier servicio compatible con OpenAI Chat Completions.

Este segundo método es necesario para dirigir al agente de Warp a través de JoinGonka Gateway: el gateway proporciona modelos de la red descentralizada de Gonka mediante una API compatible con OpenAI, el proceso de inferencia se paga a precios de mercado de la red, y para usuarios individuales o equipos pequeños, los créditos de Warp no se consumen. Tras registrarte y confirmar tu dirección, se acreditarán 3M de tokens gratuitos, suficientes para probar al agente en tus tareas antes de realizar la primera recarga.

A continuación, detallamos qué se requiere antes de empezar, qué valores introducir en el formulario de Warp, cómo verificar que las solicitudes pasen por el gateway, qué modelo de red elegir para tareas de terminal y qué es importante saber sobre la ruta de las solicitudes: en Warp, esta no funciona como en la mayoría de las herramientas.

Qué necesitarás: clave, plan de Warp y dirección pública

Clave de JoinGonka. Regístrate en el gateway, abre la sección "API-keys" en el panel y haz clic en "Crear clave". La clave comienza con jg- y solo se muestra una vez; guárdala de inmediato. Es conveniente crear una clave separada para Warp: así, en la sección "Uso", el consumo del agente de terminal se verá en una línea independiente, sin mezclarse con otras herramientas.

Plan de Warp. Tu propio endpoint está disponible no solo en planes de pago; las condiciones dependen del tamaño del equipo:

Quién conecta¿Está disponible el endpoint propio?¿Qué sucede con los créditos de Warp?
Un desarrollador o empresa de hasta 10 personas (planes Free, Build, Max)Sí, en cualquiera de estos planesNo se deducen créditos por la inferencia realizada a través de tu endpoint
Organización de más de 10 personasSolo en Business o EnterpriseLas ejecuciones locales del agente consumen platform credits (pago por infraestructura de Warp a tarifa reducida); la inferencia se paga al proveedor del endpoint

Dirección HTTPS pública. Este es un requisito de Warp que fácilmente puede pasarse por alto: las solicitudes a tu endpoint no las envía la aplicación en tu máquina, sino los servidores de Warp, por lo que la dirección debe ser accesible desde Internet. El formulario rechaza localhost, 127.0.0.1 y direcciones de redes privadas, y solo se admite el esquema https://. JoinGonka Gateway es un servicio HTTPS público, por lo que no se necesitan túneles como ngrok, que la documentación de Warp recomienda para modelos locales.

Versión reciente de la aplicación. El endpoint propio está incluido en la versión estable desde el lanzamiento del 20 de mayo de 2026, y la selección del esquema de API en el formulario apareció en la versión del 31 de julio de 2026. Si el campo API schema no aparece en el formulario, actualiza Warp.

Conexión: formulario Add custom endpoint

Toda la configuración se hace desde la interfaz de la aplicación: no hace falta editar archivos a mano.

  1. Abre Settings y escribe inference endpoint en el buscador de ajustes: Warp te llevará al bloque con las claves de proveedores y sus propios endpoints (está en la página de ajustes de Warp Agent).
  2. Pulsa Add custom endpoint: se abrirá el formulario.
  3. Rellena los campos con los valores de la tabla y pulsa Add endpoint.
Campo del formularioQué ponerExplicación
API schemaOpenAI Chat CompletionsEsquema por defecto: la documentación de Warp describe el formato de la dirección precisamente para este. En la lista también hay OpenAI Responses y Anthropic Messages
Endpoint nameJoinGonkaCualquier nombre: con él se ve el endpoint en los ajustes
Endpoint URLhttps://gate.joingonka.ai/v1Dirección base junto con /v1, igual que en el ejemplo de la documentación de Warp
API keyjg-your-keySe guarda solo en el dispositivo, en el almacén de claves del sistema
Model namedeepseek-ai/DeepSeek-V4-Flash-0731Identificador exacto del modelo, tal como lo devuelve el gateway
Model alias (optional)DeepSeek V4 FlashNombre corto para el selector de modelos

El botón + Add model añade la siguiente fila. Configura de una vez todos los modelos de la red para poder cambiar entre ellos sin volver a los ajustes: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7 y zai-org/GLM-5.3-Flash. La lista actualizada siempre la devuelve GET https://gate.joingonka.ai/v1/models. Escribe los identificadores carácter por carácter: el formulario solo comprueba el aspecto de la dirección y que los campos estén rellenos, no hace ninguna petición de prueba al guardar, así que una errata en el nombre del modelo saldrá a la luz ya en el diálogo con el agente.

Tras guardar, los modelos aparecen en el selector de modelos del agente. Si el modelo por defecto seguía siendo uno de los modelos de Warp, la aplicación puede ofrecerte cambiarlo: acepta y elige el modelo de tu endpoint. Un detalle importante: las opciones Auto del selector siempre funcionan sobre la infraestructura de Warp y consumen sus créditos, incluso cuando tu propio endpoint ya está configurado. Para que la petición salga hacia el gateway, en el selector debe estar elegido un modelo concreto de tu lista.

Verificación: si las solicitudes pasan por la pasarela

Seleccione el modelo de su endpoint en el selector y asígnele al agente una tarea corta, por ejemplo: «Muestra los cinco archivos más grandes del directorio actual y explica el comando». El agente debería sugerir el comando, ejecutarlo con su permiso y comentar el resultado.

Ahora abra el panel de la pasarela, sección «Uso». En el bloque «Por claves», en la clave configurada para Warp, aparecerán las solicitudes y el tiempo del último acceso; en el bloque «Por modelos», aparecerá el modelo seleccionado. Si los contadores aumentan, significa que la inferencia se realiza a través de JoinGonka Gateway y no con los créditos de Warp. Por su parte, Warp muestra el consumo de tokens directamente en el diálogo con el agente, bajo los nombres cortos que usted definió en el campo alias.

Si algo salió mal, la causa suele leerse en la respuesta:

Qué apareceQué significaQué hacer
401, Invalid API keyLa pasarela no reconoció la claveVerifique que la clave comience con jg-, que esté insertada sin espacios y activa en la sección «API-keys»; en caso de duda, cree una nueva
404, Invalid URL (POST …)La ruta se formó con un segmento extra; en el texto del error, la pasarela indica a dónde llegó exactamente la solicitudDebería resultar /v1/chat/completions. Si se duplicó /v1 o la dirección contiene la ruta completa, ajuste la Endpoint URL a la forma de la tabla superior
405 Not Allowed o página HTML en lugar de respuestaSe omitió /v1 en la dirección, la solicitud no llegó a la APIAñada /v1 al final de la dirección
429El modelo está sobrecargado: en horas punta, la capacidad de un modelo específico en la red puede estar agotadaIntente de nuevo en unos segundos o cambie a un modelo cercano; para esto es bueno tenerlos todos registrados de una vez
Las solicitudes pasan, pero se consumen créditos de WarpSe seleccionó Auto o el enrutador de modelos de Warp en el selector, no el modelo del endpointSeleccione el modelo específico de su lista
El formulario no acepta la direcciónWarp requiere https:// y un host públicoEscriba la dirección de la pasarela completa, comenzando con https://
El modelo «no ve» la imagen adjuntaLos modelos de la red son de texto: la pasarela reemplaza la imagen con una etiqueta de textoPara tareas con capturas de pantalla, cambie a un modelo con visión; para comandos y código, permanezca en los modelos de la red
El modelo del endpoint no aparece al iniciar en la nubeSu propio endpoint se almacena localmente y no se traslada a los Cloud AgentsEjecute la tarea con el agente local

La primera respuesta en la sesión puede tardar unos segundos: el agente envía un gran prompt del sistema con la descripción de las herramientas, y la solicitud pasa primero por los servidores de Warp y luego por el nodo de la red. Después, el diálogo es más rápido.

Qué modelo elegir para el agente de terminal

El precio de los modelos de la red es el mismo, por lo que la elección trata sobre el comportamiento, no sobre el presupuesto. El agente de terminal lee mucho (salida de comandos, logs, archivos) y llama constantemente a herramientas; todos los modelos de la tabla admiten tool calling nativo.

ModeloIdentificadorContexto y respuestaCuándo usarlo en Warp
DeepSeek V4 Flashdeepseek-ai/DeepSeek-V4-Flash-0731380K, respuesta hasta 32768 tokensModelo por defecto para el agente: sesiones largas, logs grandes y diffs, ediciones en varios archivos. Margen de contexto y el techo de respuesta más grande de la red
MiniMax M2.7MiniMaxAI/MiniMax-M2.7200K, respuesta hasta 8192 tokensTareas cortas y rápidas: buscar un comando, analizar un error, corregir un archivo de configuración
GLM-5.3 Flashzai-org/GLM-5.3-Flash390K, respuesta hasta 8192 tokensModelo de razonamiento: reflexiona antes de responder. Depuración compleja, plan de migración, análisis de código desconocido; la respuesta llega después y parte del límite de respuesta se destina al razonamiento

Esquema práctico: DeepSeek V4 Flash como modelo principal, MiniMax M2.7 para cosas pequeñas, GLM-5.3 Flash cuando la tarea depende de la lógica y no del volumen. Cambiar toma un segundo porque todos los modelos ya están configurados en el endpoint, y los nombres cortos del campo alias evitan confusiones con identificadores largos. Más detalles sobre el más utilizado en la reseña de DeepSeek V4 Flash.

Cuánto cuesta

El consumo de tokens del agente en la terminal es mayor que en el chat: para cada solicitud, Warp añade instrucciones del sistema, contexto del diálogo y descripción de las herramientas, y cada tarea consiste en varios pasos. Por eso, el precio por token aquí importa más que en una conversación habitual.

A través de JoinGonka Gateway los tokens cuestan $0.0069 por millón de entrada y $0.021 por millón de salida; el precio es igual para todos los modelos de la red y se obtiene en esta página desde una fuente en tiempo real. Orden de magnitud de los precios en septiembre de 2026:

EscenarioConsumoA través de Gateway
Tarea única: comando y análisis de su salidadecenas de miles de tokensfracciones de centavo
Día de trabajo activo con el agente3-7M de tokensunos pocos centavos
Mes de trabajo diario~150M de tokensalrededor de uno o dos dólares

A modo de comparación, tres formas de pagar el agente Warp:

MétodoQuién contabiliza la inferenciaQué limita
Modelos WarpWarp, mediante créditos del planReserva mensual de créditos del plan
BYOK: clave OpenAI, Anthropic o GoogleVendedor del modelo según su tarifaPrecio por millón de tokens del vendedor
Endpoint propio + JoinGonka GatewayGateway: por tokens, del saldoSolo saldo: el consumo se ve en el panel, sin cuotas de número de solicitudes

Warp no cobra créditos a individuos ni equipos de hasta 10 personas por trabajar a través de su propio endpoint: solo paga por los tokens en la pasarela. El saldo se recarga en el panel, donde también se pueden ver el remanente y el consumo por días y modelos.

Ruta de solicitudes y privacidad: qué es importante saber

Para la mayoría de las herramientas, un endpoint propio significa «las solicitudes van desde mi máquina directamente al proveedor». Con Warp es diferente: la parte de ejecución del agente funciona en los servidores de Warp, y un endpoint propio solo cambia el destino final y la clave. Según la documentación de Warp, el recorrido de la solicitud es el siguiente:

  1. La aplicación toma la dirección del endpoint y la clave de un almacenamiento seguro en el dispositivo y las envía a los servidores de Warp junto con su prompt.
  2. El agente del lado de Warp ensambla la solicitud completa —instrucciones del sistema, contexto del diálogo, herramientas— y llama a su endpoint con esa clave.
  3. La respuesta se devuelve a la aplicación mediante streaming a través de los mismos servidores.

Qué significa esto en la práctica:

  • Clave. Se almacena solo en el dispositivo. Pasa a través de los servidores de Warp en cada solicitud, pero, según Warp, no se guarda allí: se utiliza al vuelo y se descarta.
  • Prompts y respuestas. Se transmiten a través del backend de Warp. Warp declara que no utiliza este contenido para el entrenamiento, y el almacenamiento y la analítica están sujetos a la configuración de privacidad y telemetría de su cuenta. La garantía ZDR, que se aplica a los modelos del propio Warp, no puede extenderse a su propio endpoint: lo que el proveedor almacena lo determina el proveedor.
  • Lado de la pasarela. JoinGonka Gateway no almacena diálogos: los prompts y respuestas no permanecen en la pasarela después de la respuesta; en el panel solo se ven los contadores de solicitudes y tokens.
  • Qué permanece en la infraestructura de Warp. Las opciones Auto, los enrutadores de modelos de usuario, Codebase Context, las sugerencias de Active AI y los agentes en la nube: un endpoint propio no afecta a estos elementos.

Si para sus tareas el camino a través de servidores externos es inaceptable, utilice un agente que se dirija al endpoint directamente desde su máquina, como Codex CLI o cualquier herramienta de la guía de inicio rápido de API. El propio Warp promete en su anuncio una versión cliente: un módulo de agente ligero en Rust en un repositorio abierto, que se conectará a modelos locales sin pasar por los servidores de Warp, y compatibilidad con el Agent Client Protocol. Y desde el lanzamiento del 2 de septiembre de 2026, las descripciones de los endpoints se almacenan en un archivo de configuración en un formato común para la aplicación y Warp Agent CLI; las claves no entran en este archivo y permanecen en el almacenamiento seguro.

Warp se conecta a JoinGonka Gateway a través del formulario Add custom endpoint: esquema OpenAI Chat Completions, dirección https://gate.joingonka.ai/v1, clave jg- e identificadores de modelos de la red. Para usuarios individuales y equipos de hasta 10 personas, esto está disponible incluso en el plan gratuito, y los créditos de Warp para inferencia no se consumen si se selecciona el modelo endpoint en el interruptor en lugar de Auto. La característica principal de Warp es la ruta: las solicitudes al endpoint las envían sus servidores, por lo que la dirección debe ser pública y los prompts pasan por el backend de Warp en tránsito. Para tareas de terminal, use DeepSeek V4 Flash; para tareas pequeñas, MiniMax M2.7; y para lógica compleja, GLM-5.3 Flash.

¿Quieres saber más?

Explora otras secciones o empieza a ganar GNK ahora mismo.

Obtener clave y tokens gratuitos →