Secciones de la base de conocimientos ▾
Navegación
▸ Empiece aquí Por rolesCategorías
- Cursor + Gonka AI — LLM barato para codificación
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — Agentes de IA accesibles
- OpenCode: tu propio modelo en la terminal
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — Agente de IA en VS Code
- Aider + Gonka AI — Programación en pareja con IA
- LangChain + Gonka AI — Aplicaciones de IA por centavos
- n8n + Gonka AI — Automatización con IA barata
- Open WebUI + Gonka AI — Su propio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código abierto
- Hermes Agent + DeepSeek en la red Gonka: agente autónomo por centavos
- Kilo Code + Gonka AI — agente de IA en VS Code
- Roo Code + Gonka AI — agente de IA autónomo en VS Code
- LlamaIndex + Gonka AI — Aplicaciones RAG por centavos
- PydanticAI + Gonka — Agentes de IA tipados por centavos
- Vercel AI SDK + Gonka AI — Aplicaciones de IA en TypeScript por centavos
- TanStack AI + Gonka — Aplicaciones de IA en TypeScript por centavos
- API inicio rápido — curl, Python, TypeScript
- JoinGonka Gateway — Resumen completo
- Management Keys — SaaS en Gonka
- La API de IA más barata: comparación de proveedores 2026
- Cómo comprar tokens de AI y una clave API: 3 métodos en 2026
- Límite de solicitudes de Cursor Pro alcanzado — análisis y una alternativa barata
- Claude Code más barato — análisis de factura y cambio de servicio
- Cline quema dinero — por qué el agente gasta tanto
- OpenClaw sale caro: por qué el agente quema tokens y cómo ahorrar
- OpenRouter: alternativa barata — comparativa con JoinGonka Gateway
- El mejor modelo de IA para codificación en 2026: comparativa y precios
- Alternativa barata a GitHub Copilot sin límites
- Alternativa barata a Windsurf sin créditos ni límites
- La API más barata para agentes de IA en 2026
- ZCode: inferencia GLM barata en lugar de GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — tu propio endpoint en lugar de créditos
- GitHub Copilot BYOK: tus modelos en lugar de la cuota
- Zed + JoinGonka Gateway — inferencia económica en el editor
- Pi + JoinGonka Gateway — agente terminal con inferencia económica
- Codex CLI: su propia clave en lugar de suscripción
- DeepSeek Harness: tu propio proveedor a través de JoinGonka Gateway
- MiniMax Code: agente MiniMax con tu propia clave a través de Gonka
- Warp + JoinGonka Gateway: agente de terminal en tu propio endpoint
- Trae + JoinGonka Gateway — modelos de la red Gonka en AI-IDE
- Cherry Studio + JoinGonka Gateway — cliente de IA de escritorio
- omp (Oh My Pi) + JoinGonka Gateway: agente con roles de modelos
- OpenHands + JoinGonka Gateway: agente en su propio endpoint
- Qwen Code tras el cierre de qwen-oauth: trabajando a través de JoinGonka Gateway
- Goose + JoinGonka Gateway: su propio proveedor y clave en keyring
- Crush + JoinGonka Gateway: agente Charm en modelos de la red Gonka
- Zoo Code + JoinGonka Gateway: migración de Roo Code a modelos Gonka
- Kimi Code CLI: agente de Moonshot AI con su propia clave a través de Gonka
- Factory Droid + JoinGonka Gateway: BYOK en modelos de la red Gonka
- MiMo Code + JoinGonka Gateway: agente Xiaomi en modelos de red Gonka
Herramientas
LangChain + Gonka AI — Aplicaciones de IA por centavos
LangChain es el framework más popular para crear aplicaciones de AI en Python y JavaScript. Pipelines de RAG, cadenas (chains), agentes y manejo de documentos: LangChain proporciona abstracciones para todo esto.
LangChain admite de forma nativa API compatibles con OpenAI a través de la clase ChatOpenAI. Esto significa que JoinGonka Gateway se integra en 3 líneas de código, sin paquetes ni configuraciones adicionales.
Resultado: un sistema RAG, un chatbot o un agente de AI funcionando por $0.0069/1M de tokens en lugar de los $2.50-15 de OpenAI.
Inicio rápido: 3 líneas de código
Ejemplo mínimo — conectar LangChain a Gonka:
from langchain_openai import ChatOpenAI
llm = ChatOpenAI(
base_url="https://gate.joingonka.ai/v1",
api_key="jg-your-key",
model="MiniMaxAI/MiniMax-M2.7",
)
response = llm.invoke("Explain what RAG is")
print(response.content)Eso es todo. Tres líneas — y tu proyecto de LangChain funciona a través de la red descentralizada Gonka por muy pocos céntimos.
Instalación de dependencias:
pip install langchain langchain-openaiRecomendación: especifica max_tokens=8192 explícitamente — es el tope de salida a través de JoinGonka Gateway para MiniMax M2.7 y GLM-5.3 Flash (en DeepSeek V4 Flash es de hasta 32768). La ventana de contexto es de 200K tokens en MiniMax M2.7 (380K en DeepSeek V4 Flash, 390K en GLM-5.3 Flash) — tenlo en cuenta al configurar chunk_size en tus pipelines RAG.
Ejemplo: pipeline RAG con Gonka
RAG (Retrieval-Augmented Generation) es el patrón más popular en aplicaciones de IA. Cargas documentos, los divides en fragmentos, creas embeddings, buscas los fragmentos relevantes y generas una respuesta con contexto.
from langchain_openai import ChatOpenAI
from langchain.text_splitter import RecursiveCharacterTextSplitter
from langchain.chains import RetrievalQA
from langchain_community.vectorstores import FAISS
from langchain_community.embeddings import HuggingFaceEmbeddings
from langchain_community.document_loaders import TextLoader
# 1. LLM via Gonka
llm = ChatOpenAI(
base_url="https://gate.joingonka.ai/v1",
api_key="jg-your-key",
model="MiniMaxAI/MiniMax-M2.7",
streaming=True,
)
# 2. Load and index documents
loader = TextLoader("docs/my_document.txt")
docs = loader.load()
splitter = RecursiveCharacterTextSplitter(chunk_size=1000)
chunks = splitter.split_documents(docs)
# 3. Vector store (local, free)
embeddings = HuggingFaceEmbeddings()
vectorstore = FAISS.from_documents(chunks, embeddings)
# 4. RAG chain
qa = RetrievalQA.from_chain_type(
llm=llm,
retriever=vectorstore.as_retriever(),
)
# 5. Query
result = qa.invoke("What is this document about?")
print(result["result"])Coste: una sola consulta al pipeline RAG (retrieval + generation) consume ~2-5K tokens del LLM. Con Gonka son $0.00001-0.000024. Con OpenAI, $0.005-0.05. La diferencia: 1.300x.
Para sistemas en producción que procesan miles de consultas al día, el ahorro asciende a decenas de miles de dólares al mes.
Ejemplo: agente de IA con tool calling
LangChain te permite crear agentes con herramientas (tools). Los modelos de la red admiten tool calling nativo, así que los agentes funcionan de forma fiable, sin parsear respuestas de texto.
from langchain_openai import ChatOpenAI
from langchain.agents import create_openai_tools_agent, AgentExecutor
from langchain.tools import tool
from langchain.prompts import ChatPromptTemplate
llm = ChatOpenAI(
base_url="https://gate.joingonka.ai/v1",
api_key="jg-your-key",
model="MiniMaxAI/MiniMax-M2.7",
)
@tool
def calculator(expression: str) -> str:
"""Evaluates a math expression."""
return str(eval(expression))
@tool
def search_web(query: str) -> str:
"""Searches the web for information."""
return f"Search results for: {query}"
prompt = ChatPromptTemplate.from_messages([
("system", "You are a helpful assistant."),
("human", "{input}"),
("placeholder", "{agent_scratchpad}"),
])
agent = create_openai_tools_agent(llm, [calculator, search_web], prompt)
executor = AgentExecutor(agent=agent, tools=[calculator, search_web])
result = executor.invoke({"input": "What is 2**10 * 3.14?"})
print(result["output"])El agente llama a calculator, obtiene el resultado y formula la respuesta. Todo el ciclo cuesta ~$0.00005 con Gonka. Con OpenAI, $0.01-0.05. Para sistemas con miles de usuarios, esa diferencia son decenas de miles de dólares.
¿Quieres saber más?
Explora otras secciones o empieza a ganar GNK ahora mismo.
Obtener tokens gratuitos →