지식 기반 섹션 ▾
내비게이션
▸ 여기서 시작하세요 역할별카테고리
- Cursor + Gonka AI — 코딩을 위한 저렴한 LLM
- Claude Code + Gonka AI — 터미널을 위한 LLM
- OpenClaw + Gonka AI — 저렴한 AI 에이전트
- OpenCode: 터미널에서 나만의 모델 사용
- Continue.dev + Gonka AI — VS Code/JetBrains를 위한 AI
- Cline + Gonka AI — VS Code의 AI 에이전트
- Aider + Gonka AI — AI 페어 프로그래밍
- LangChain + Gonka AI — 저렴한 AI 애플리케이션
- n8n + Gonka AI — 저렴한 AI로 자동화
- Open WebUI + Gonka AI — 나만의 ChatGPT
- LibreChat + Gonka AI — 오픈소스 ChatGPT
- Gonka 네트워크의 Hermes Agent + DeepSeek — 초저비용 자율 에이전트
- Kilo Code + Gonka AI — VS Code용 AI 에이전트
- Roo Code + Gonka AI — VS Code용 자율 AI 에이전트
- LlamaIndex + Gonka AI — 저렴한 RAG 애플리케이션
- PydanticAI + Gonka — 저렴한 유형화된 AI 에이전트
- Vercel AI SDK + Gonka AI — 저렴한 TypeScript AI 애플리케이션
- TanStack AI + Gonka — 저렴한 TypeScript AI 애플리케이션
- API 빠른 시작 — curl, Python, TypeScript
- JoinGonka Gateway — 전체 개요
- 관리 키 — Gonka 위의 SaaS
- 가장 저렴한 AI API: 2026년 제공업체 비교
- AI 토큰 및 API 키 구매 방법: 2026년 3가지 방법
- Cursor Pro 쿼리 제한 종료 — 분석 및 저렴한 대안
- 더 저렴한 Claude Code — 청구액 분석 및 전환
- Cline의 엄청난 비용 — 에이전트가 예산을 소모하는 이유
- OpenClaw 비용 부담 — 에이전트가 토큰을 소모하는 이유와 절약 전략
- OpenRouter: 저렴한 대안 — JoinGonka Gateway와 비교
- 2026년 최고의 코딩용 AI 모델: 비교 및 가격
- GitHub Copilot의 저렴한 무제한 대체 서비스
- 크레딧과 제한 없는 저렴한 Windsurf 대안
- 2026년 AI 에이전트를 위한 가장 저렴한 API
- ZCode: GLM Coding Plan 대신 사용하는 저렴한 GLM 추론
- JetBrains IDE + JoinGonka Gateway — 크레딧 대신 자체 endpoint 사용
- GitHub Copilot BYOK — 할당량 대신 자체 모델 사용
- Zed + JoinGonka Gateway — 에디터 내 저렴한 추론
- Pi + JoinGonka Gateway — 저렴한 인퍼런스를 활용한 터미널 에이전트
- Codex CLI: 구독 대신 자체 키 사용
- DeepSeek Harness: JoinGonka Gateway를 통한 자체 프로바이더
- MiniMax Code: Gonka를 통해 자체 키로 작동하는 MiniMax 에이전트
- Warp + JoinGonka Gateway — 엔드포인트 터미널 에이전트
- Trae + JoinGonka Gateway — AI-IDE에서 Gonka 네트워크 모델 활용하기
- Cherry Studio + JoinGonka Gateway — 데스크톱 AI 클라이언트
- omp (Oh My Pi) + JoinGonka Gateway: 모델 역할을 갖춘 에이전트
- OpenHands + JoinGonka Gateway: 나만의 엔드포인트 에이전트
- qwen-oauth 종료 후의 Qwen Code: JoinGonka Gateway를 통한 작업
- Goose + JoinGonka Gateway: 키링을 통한 제공자 및 키 관리
- Crush + JoinGonka Gateway: Gonka 네트워크 모델 기반의 Charm 에이전트
- Zoo Code + JoinGonka Gateway: Roo Code에서 Gonka 모델로 이전하기
- Kimi Code CLI: Gonka를 통해 나만의 키로 사용하는 Moonshot AI 에이전트
- Factory Droid + JoinGonka Gateway: Gonka 네트워크 모델에서의 BYOK
- MiMo Code + JoinGonka Gateway: Gonka 네트워크 모델 기반 Xiaomi 에이전트
도구
GitHub Copilot BYOK — 할당량 대신 자체 모델 사용
BYOK (bring your own key)는 GitHub Copilot의 공식 메커니즘으로, 자체 모델 공급자를 연결하여 내장된 GPT나 Claude 대신 에이전트 세션을 실행할 수 있게 해줍니다. 2026년 1월부터 모든 OpenAI 호환 엔드포인트가 지원되며, 6월 23일부터는 Copilot 앱 내에서 모든 유료 플랜을 대상으로 public preview가 제공되고, 7월 14일부터는 JetBrains 버전에서도 지원됩니다. 즉, Copilot을 쉘로 사용하면서 추론(inference)은 JoinGonka Gateway를 통해 수행함으로써, 탈중앙화 네트워크 Gonka의 가격 혜택을 누리고 구독의 프리미엄 요청 한도를 소진하지 않을 수 있습니다. VS Code에서의 BYOK 사용을 위해 Copilot 플랜이나 GitHub 계정 로그인이 필수는 아닙니다.
BYOK의 장점 및 필요성
Copilot 구독은 프리미엄 요청을 월 단위로 제한하며, 에이전트 세션, 리팩토링, 다단계 작업이 할당량을 가장 빨리 소모합니다. BYOK는 이러한 호출을 자신의 제공자로 라우팅하여 Copilot의 프리미엄 할당량을 소모하지 않고 자신의 제공자 가격으로 청구되도록 합니다. 키는 시스템 키체인에 저장되며 인터페이스가 읽을 수 없습니다.
한도에 도달했거나, 오픈 웨이트 모델을 사용하고 싶거나, 추론 비용을 훨씬 더 저렴하게 지불하고 싶을 때 BYOK는 합리적인 선택입니다. Gonka 네트워크는 벤더의 표준 가격보다 수백 배 저렴하게 오픈 소스 모델을 제공하며, 실제 가격은 언제나 게이트웨이의 실시간 가격표에서 확인할 수 있습니다.
타임라인: 출시 기록
| 시기 | 신규 기능 |
|---|---|
| 2025년 11월 | BYOK public preview: Anthropic, OpenAI, xAI, Microsoft Foundry 지원; VS Code, JetBrains, Eclipse, Xcode에서 Agent, Plan, Ask, Edit 모드 제공 |
| 2026년 1월 | 모든 OpenAI 호환 공급자 및 AWS Bedrock, Google AI Studio 지원; Responses API 모델 지원 |
| 2026년 6월 23일 | GitHub Copilot 앱 내 BYOK — 모든 유료 플랜 대상 public preview |
| 2026년 6월 18일 | VS Code: GitHub 로그인 및 Copilot 플랜 없이 BYOK 작동; 비용은 공급자 측에서 발생하며 Copilot 요청 쿼터를 소진하지 않음 |
| 2026년 7월 14일 | JetBrains용 Copilot에서 커스텀 OpenAI 호환 엔드포인트 지원 — 모든 요금제 적용 |
JoinGonka Gateway 연결 단계
jg-… 키가 필요합니다. 이 키는 게이트웨이 등록 시 스타터 3M 무료 토큰과 함께 발급되며, 카드는 필요하지 않습니다. 키와 모델은 각 Copilot 클라이언트마다 개별적으로 설정합니다 — 아래 세 가지 방법을 소개합니다.
VS Code — Custom Endpoint 프로바이더. 이것이 현재的方法입니다. 기존의 "OpenAI Compatible" 프로바이더와 github.copilot.chat.customOAIModels 설정은 더 이상 사용되지 않습니다.
| 단계 | 작업 |
|---|---|
| 1. 모델 편집기 | 명령 팔레트 → Chat: Manage Language Models(또는 채팅 모델 목록의 톱니바퀴 아이콘) |
| 2. 프로바이더 | Add Models → Custom Endpoint; 그룹 이름은 예를 들어 JoinGonka |
| 3. 키 | 당신의 jg-…를 붙여넣으세요 — VS Code는 파일이 아닌 자체 보안 저장소에 보관합니다 |
| 4. API 유형 | Chat Completions |
| 5. 모델 | VS Code가 chatLanguageModels.json을 엽니다 — 새 그룹의 "models" 배열을 아래 블록으로 교체하고 파일을 저장하세요 |
| 6. 선택 | 채팅 모델 목록에서 모델을 선택하세요. 나타나지 않으면 VS Code를 재시작하세요 |
"models": [
{
"id": "deepseek-ai/DeepSeek-V4-Flash-0731",
"name": "DeepSeek V4 Flash (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 347232,
"maxOutputTokens": 32768
},
{
"id": "MiniMaxAI/MiniMax-M2.7",
"name": "MiniMax M2.7 (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 191808,
"maxOutputTokens": 8192
},
{
"id": "zai-org/GLM-5.3-Flash",
"name": "GLM 5.3 Flash (Gonka)",
"url": "https://gate.joingonka.ai/v1/chat/completions",
"toolCalling": true,
"vision": false,
"maxInputTokens": 381808,
"maxOutputTokens": 8192
}
]maxInputTokens는 모델의 컨텍스트 윈도우에서 응답 상한을 뺀 값입니다. maxOutputTokens와 함께 윈도우를 정의합니다. toolCalling: true가 없으면 에이전트 사용 시 모델이 목록에 나타나지 않습니다.
Copilot CLI — 환경 변수만 사용. 이 프로바이더에는 설정 파일이 없으며, 값은 copilot을 실행하는 셸에서 설정합니다:
export COPILOT_PROVIDER_BASE_URL=https://gate.joingonka.ai/v1
export COPILOT_PROVIDER_TYPE=openai
export COPILOT_PROVIDER_API_KEY=jg-your-key
export COPILOT_MODEL=deepseek-ai/DeepSeek-V4-Flash-0731
export COPILOT_PROVIDER_MAX_PROMPT_TOKENS=347232
export COPILOT_PROVIDER_MAX_OUTPUT_TOKENS=32768
copilotCOPILOT_PROVIDER_* 이름은 Copilot CLI만 읽기 때문에 이 설정이 다른 도구에 영향을 주지 않습니다. CLI는 모델에 tool calling과 스트리밍을 요구하며, 네트워크의 모든 모델이 이를 지원합니다.
JetBrains — GitHub Copilot 플러그인. Copilot Chat 열기 → 모델 목록 → Manage Models를 선택하고 OpenAI 호환 엔드포인트 프로바이더를 고른 뒤 Add Models를 클릭하고 Base URL https://gate.joingonka.ai/v1, 키 jg-…, 모델 식별자를 입력하세요. Save를 클릭하고 자신의 키 아래에 있는 모델을 체크한 후 다시 저장하면 내장 모델 옆에 나타납니다.
팁. npx @joingonka/setup --tool copilot-byok 명령을 실행하면 세 섹션 모두가 당신의 키와 선택한 모델의 실제 한도와 함께 출력됩니다 — VS Code용 "models" 배열도 포함되며 — 라이브 요청으로 게이트웨이가 키와 모델을 받아들이는지도 검증합니다. 파일은 전혀 쓰지 않습니다. 각 Copilot 클라이언트는 키를 자체 저장소에 보관합니다.
네트워크 모델 선택 가이드
네트워크의 세 가지 모델 모두 스트리밍과 tool calling을 지원합니다. deepseek-ai/DeepSeek-V4-Flash-0731 — 네트워크에서 가장 긴 컨텍스트(380K 토큰)와 최대 32768 토큰의 가장 큰 출력을 제공하므로 대규모 리포지토리 및 긴 에이전트 세션에 적합합니다. MiniMaxAI/MiniMax-M2.7 — 범용 모델로, 출력은 최대 8192 토큰입니다. zai-org/GLM-5.3-Flash — 네트워크에서 가장 긴 컨텍스트(390K 토큰)를 가진 Z.ai의 추론(reasoning) 모델로, 답변 전에 추론을 수행하며 최대 8192 토큰을 출력합니다. 답변 예산의 일부가 추론에 사용되므로 설정에서 출력 제한을 너무 낮게 잡지 마십시오.
public preview 제한 사항
BYOK는 에이전트 세션과 채팅을 지원하지만, 인라인 제안 및 프로젝트 전체 시맨틱 검색은 여전히 Copilot 모델을 사용하며 GitHub 계정이 필요합니다. 이는 프로바이더가 아닌 Copilot 자체의 제한입니다. Copilot Business 및 Enterprise에서 로컬 BYOK는 관리자 정책('Bring Your Own Language Model Key')에 의해 제어됩니다. 인터페이스에 항목이 없으면 조직 차원에서 비활성화된 것입니다. 게이트웨이를 통한 Vision 작업은 작동하지 않는데, 네트워크 모델은 텍스트 전용이기 때문입니다. 도구가 Responses API 형식으로 요청을 보내면 게이트웨이가 이를 수락합니다(POST /v1/responses). 스트리밍 및 Function Tools도 작동합니다. 대화 이력은 저장하지 않으므로 store는 무시되며, previous_response_id는 오류를 반환합니다. 전체 대화 이력을 input에 전달하세요.