Secciones de la base de conocimientos ▾
Navegación
▸ Empiece aquí Por rolesCategorías
- Cursor + Gonka AI — LLM barato para codificación
- Claude Code + Gonka AI — LLM para terminal
- OpenClaw + Gonka AI — Agentes de IA accesibles
- OpenCode: tu propio modelo en la terminal
- Continue.dev + Gonka AI — AI para VS Code/JetBrains
- Cline + Gonka AI — Agente de IA en VS Code
- Aider + Gonka AI — Programación en pareja con IA
- LangChain + Gonka AI — Aplicaciones de IA por centavos
- n8n + Gonka AI — Automatización con IA barata
- Open WebUI + Gonka AI — Su propio ChatGPT
- LibreChat + Gonka AI — ChatGPT de código abierto
- Hermes Agent + DeepSeek en la red Gonka: agente autónomo por centavos
- Kilo Code + Gonka AI — agente de IA en VS Code
- Roo Code + Gonka AI — agente de IA autónomo en VS Code
- LlamaIndex + Gonka AI — Aplicaciones RAG por centavos
- PydanticAI + Gonka — Agentes de IA tipados por centavos
- Vercel AI SDK + Gonka AI — Aplicaciones de IA en TypeScript por centavos
- TanStack AI + Gonka — Aplicaciones de IA en TypeScript por centavos
- API inicio rápido — curl, Python, TypeScript
- JoinGonka Gateway — Resumen completo
- Management Keys — SaaS en Gonka
- La API de IA más barata: comparación de proveedores 2026
- Límite de solicitudes de Cursor Pro alcanzado — análisis y una alternativa barata
- Claude Code más barato — análisis de factura y cambio de servicio
- Cline quema dinero — por qué el agente gasta tanto
- OpenClaw sale caro: por qué el agente quema tokens y cómo ahorrar
- OpenRouter: alternativa barata — comparativa con JoinGonka Gateway
- El mejor modelo de IA para codificación en 2026: comparativa y precios
- Alternativa barata a GitHub Copilot sin límites
- Alternativa barata a Windsurf sin créditos ni límites
- La API más barata para agentes de IA en 2026
- ZCode: inferencia GLM barata en lugar de GLM Coding Plan
- JetBrains IDE + JoinGonka Gateway — tu propio endpoint en lugar de créditos
- GitHub Copilot BYOK: tus modelos en lugar de la cuota
- Zed + JoinGonka Gateway — inferencia económica en el editor
- Pi + JoinGonka Gateway — agente terminal con inferencia económica
- Codex CLI: su propia clave en lugar de suscripción
Herramientas
LangChain + Gonka AI — Aplicaciones de IA por centavos
LangChain es el framework más popular para crear aplicaciones de AI en Python y JavaScript. Pipelines de RAG, cadenas (chains), agentes y manejo de documentos: LangChain proporciona abstracciones para todo esto.
LangChain admite de forma nativa API compatibles con OpenAI a través de la clase ChatOpenAI. Esto significa que JoinGonka Gateway se integra en 3 líneas de código, sin paquetes ni configuraciones adicionales.
Resultado: un sistema RAG, un chatbot o un agente de AI funcionando por $0.0047/1M de tokens en lugar de los $2.50-15 de OpenAI.
Inicio rápido: 3 líneas de código
Ejemplo mínimo: conectar LangChain a Gonka:
from langchain_openai import ChatOpenAI
llm = ChatOpenAI(
base_url="https://gate.joingonka.ai/v1",
api_key="jg-tu-clave",
model="MiniMaxAI/MiniMax-M2.7",
)
response = llm.invoke("Explica qué es RAG")
print(response.content)Eso es todo. Tres líneas y tu proyecto LangChain funciona a través de la red descentralizada Gonka por una fracción del costo.
Instalación de dependencias:
pip install langchain langchain-openaiRecomendación: especifique explícitamente max_tokens=8192: este es el límite de salida a través del JoinGonka Gateway para todos los modelos de la red. La ventana de contexto de los modelos de la red es de 200K tokens: téngalo en cuenta al configurar chunk_size en los pipelines de RAG.
Ejemplo: pipeline RAG con Gonka
RAG (Retrieval-Augmented Generation) es el patrón más popular de aplicaciones de IA. Subes documentos, los divides en trozos, creas embeddings, buscas fragmentos relevantes y generas una respuesta con contexto.
from langchain_openai import ChatOpenAI
from langchain.text_splitter import RecursiveCharacterTextSplitter
from langchain.chains import RetrievalQA
from langchain_community.vectorstores import FAISS
from langchain_community.embeddings import HuggingFaceEmbeddings
from langchain_community.document_loaders import TextLoader
# 1. LLM vía Gonka
llm = ChatOpenAI(
base_url="https://gate.joingonka.ai/v1",
api_key="jg-tu-clave",
model="MiniMaxAI/MiniMax-M2.7",
streaming=True,
)
# 2. Carga e indexación de documentos
loader = TextLoader("docs/my_document.txt")
docs = loader.load()
splitter = RecursiveCharacterTextSplitter(chunk_size=1000)
chunks = splitter.split_documents(docs)
# 3. Almacenamiento vectorial (local, gratuito)
embeddings = HuggingFaceEmbeddings()
vectorstore = FAISS.from_documents(chunks, embeddings)
# 4. Cadena RAG
qa = RetrievalQA.from_chain_type(
llm=llm,
retriever=vectorstore.as_retriever(),
)
# 5. Consulta
result = qa.invoke("¿De qué trata este documento?")
print(result["result"])Coste: una consulta de pipeline RAG (recuperación + generación) utiliza ~2-5K tokens de LLM. A través de Gonka esto son $0.00001-0.000024. A través de OpenAI — $0.005-0.05. La diferencia es de 1,300x.
Para sistemas en producción que procesan miles de solicitudes al día, el ahorro asciende a decenas de miles de dólares al mes.
Ejemplo: agente de IA con tool calling
LangChain permite crear agentes con herramientas (tools). Kimi K2.6 admite tool calling nativo, por lo que los agentes funcionan de forma fiable sin necesidad de analizar respuestas de texto.
from langchain_openai import ChatOpenAI
from langchain.agents import create_openai_tools_agent, AgentExecutor
from langchain.tools import tool
from langchain.prompts import ChatPromptTemplate
llm = ChatOpenAI(
base_url="https://gate.joingonka.ai/v1",
api_key="jg-tu-clave",
model="MiniMaxAI/MiniMax-M2.7",
)
@tool
def calculator(expression: str) -> str:
"""Calcula una expresión matemática."""
return str(eval(expression))
@tool
def search_web(query: str) -> str:
"""Busca información en internet."""
return f"Resultados de búsqueda para: {query}"
prompt = ChatPromptTemplate.from_messages([
("system", "Eres un asistente útil."),
("human", "{input}"),
("placeholder", "{agent_scratchpad}"),
])
agent = create_openai_tools_agent(llm, [calculator, search_web], prompt)
executor = AgentExecutor(agent=agent, tools=[calculator, search_web])
result = executor.invoke({"input": "¿Cuánto es 2**10 * 3.14?"})
print(result["output"])El agente invoca a calculator, obtiene el resultado y genera la respuesta. El ciclo completo cuesta ~$0.00005 a través de Gonka. Con OpenAI, $0.01-$0.05. Para sistemas con miles de usuarios, esto supone una diferencia de decenas de miles de dólares.
¿Quieres saber más?
Explora otras secciones o empieza a ganar GNK ahora mismo.
Obtener tokens gratuitos →