지식 기반 섹션 ▾
내비게이션
▸ 여기서 시작하세요 역할별카테고리
- Cursor + Gonka AI — 코딩을 위한 저렴한 LLM
- Claude Code + Gonka AI — 터미널을 위한 LLM
- OpenClaw + Gonka AI — 저렴한 AI 에이전트
- OpenCode: 터미널에서 나만의 모델 사용
- Continue.dev + Gonka AI — VS Code/JetBrains를 위한 AI
- Cline + Gonka AI — VS Code의 AI 에이전트
- Aider + Gonka AI — AI 페어 프로그래밍
- LangChain + Gonka AI — 저렴한 AI 애플리케이션
- n8n + Gonka AI — 저렴한 AI로 자동화
- Open WebUI + Gonka AI — 나만의 ChatGPT
- LibreChat + Gonka AI — 오픈소스 ChatGPT
- Gonka 네트워크의 Hermes Agent + DeepSeek — 초저비용 자율 에이전트
- Kilo Code + Gonka AI — VS Code용 AI 에이전트
- Roo Code + Gonka AI — VS Code용 자율 AI 에이전트
- LlamaIndex + Gonka AI — 저렴한 RAG 애플리케이션
- PydanticAI + Gonka — 저렴한 유형화된 AI 에이전트
- Vercel AI SDK + Gonka AI — 저렴한 TypeScript AI 애플리케이션
- TanStack AI + Gonka — 저렴한 TypeScript AI 애플리케이션
- API 빠른 시작 — curl, Python, TypeScript
- JoinGonka Gateway — 전체 개요
- 관리 키 — Gonka 위의 SaaS
- 가장 저렴한 AI API: 2026년 제공업체 비교
- AI 토큰 및 API 키 구매 방법: 2026년 3가지 방법
- Cursor Pro 쿼리 제한 종료 — 분석 및 저렴한 대안
- 더 저렴한 Claude Code — 청구액 분석 및 전환
- Cline의 엄청난 비용 — 에이전트가 예산을 소모하는 이유
- OpenClaw 비용 부담 — 에이전트가 토큰을 소모하는 이유와 절약 전략
- OpenRouter: 저렴한 대안 — JoinGonka Gateway와 비교
- 2026년 최고의 코딩용 AI 모델: 비교 및 가격
- GitHub Copilot의 저렴한 무제한 대체 서비스
- 크레딧과 제한 없는 저렴한 Windsurf 대안
- 2026년 AI 에이전트를 위한 가장 저렴한 API
- ZCode: GLM Coding Plan 대신 사용하는 저렴한 GLM 추론
- JetBrains IDE + JoinGonka Gateway — 크레딧 대신 자체 endpoint 사용
- GitHub Copilot BYOK — 할당량 대신 자체 모델 사용
- Zed + JoinGonka Gateway — 에디터 내 저렴한 추론
- Pi + JoinGonka Gateway — 저렴한 인퍼런스를 활용한 터미널 에이전트
- Codex CLI: 구독 대신 자체 키 사용
- DeepSeek Harness: JoinGonka Gateway를 통한 자체 프로바이더
- MiniMax Code: Gonka를 통해 자체 키로 작동하는 MiniMax 에이전트
- Warp + JoinGonka Gateway — 엔드포인트 터미널 에이전트
- Trae + JoinGonka Gateway — AI-IDE에서 Gonka 네트워크 모델 활용하기
- Cherry Studio + JoinGonka Gateway — 데스크톱 AI 클라이언트
- omp (Oh My Pi) + JoinGonka Gateway: 모델 역할을 갖춘 에이전트
- OpenHands + JoinGonka Gateway: 나만의 엔드포인트 에이전트
- qwen-oauth 종료 후의 Qwen Code: JoinGonka Gateway를 통한 작업
- Goose + JoinGonka Gateway: 키링을 통한 제공자 및 키 관리
- Crush + JoinGonka Gateway: Gonka 네트워크 모델 기반의 Charm 에이전트
- Zoo Code + JoinGonka Gateway: Roo Code에서 Gonka 모델로 이전하기
- Kimi Code CLI: Gonka를 통해 나만의 키로 사용하는 Moonshot AI 에이전트
- Factory Droid + JoinGonka Gateway: Gonka 네트워크 모델에서의 BYOK
- MiMo Code + JoinGonka Gateway: Gonka 네트워크 모델 기반 Xiaomi 에이전트
도구
Warp + JoinGonka Gateway — 엔드포인트 터미널 에이전트
Warp는 에이전트 개발 환경으로 성장한 터미널입니다. 내장된 Warp Agent는 명령 출력을 읽고, 파일을 수정하며, 빌드를 실행하고, 요청부터 결과까지 작업을 관리합니다. 기본적으로 에이전트는 Warp가 판매하는 모델을 Warp 요금제 크레딧으로 사용하지만, 과거에는 유료 플랜에서 OpenAI, Anthropic 또는 Google 키를 사용하는 경우에만 자체 추론 환경을 가져올 수 있었습니다. 2026년 5월 20일, Warp는 무료 플랜에 BYOK를 도입하고 OpenAI Chat Completions와 호환되는 모든 서비스를 연결할 수 있는 custom inference endpoint를 추가했습니다.
이 두 번째 방법은 Warp 에이전트를 JoinGonka Gateway를 통해 실행하는 데 사용됩니다. 이 게이트웨이는 분산형 네트워크 Gonka의 모델을 OpenAI 호환 API로 제공하며, 추론 비용은 네트워크 실시간 가격으로 결제되므로 개인이나 소규모 팀은 Warp 크레딧을 소비할 필요가 없습니다. 가입 및 주소 인증 후 계정에 3M 무료 토큰이 지급되며, 첫 충전 전에 자신의 작업에 에이전트를 시험해 볼 수 있습니다.
아래에서는 시작 전 필요한 사항, Warp 폼에 입력할 값, 요청이 게이트웨이를 통과하는지 확인하는 방법, 터미널 작업에 적합한 네트워크 모델 선택, 그리고 대부분의 도구와는 다른 Warp의 요청 경로에 대해 알아야 할 중요한 사항을 다룹니다.
필요한 것: 키, Warp 플랜 및 공용 주소
JoinGonka 키. 게이트웨이에 가입한 후, 대시보드에서 'API 키' 섹션을 열고 '키 생성'을 클릭하세요. 키는 jg-로 시작하며 한 번만 표시되므로 바로 저장해야 합니다. Warp용 키를 따로 생성하면 '사용량' 섹션에서 터미널 에이전트 사용량을 다른 도구와 분리하여 확인할 수 있어 편리합니다.
Warp 플랜. 자체 엔드포인트는 유료 플랜뿐만 아니라 팀 규모에 따라 다음과 같이 사용할 수 있습니다:
| 연결 주체 | 자체 엔드포인트 사용 가능 여부 | Warp 크레딧 처리 |
|---|---|---|
| 개인 개발자 또는 10인 이하 기업 (Free, Build, Max 플랜) | 가능 (해당 플랜 모두에서 사용 가능) | 자체 엔드포인트를 통한 추론 시 크레딧 차감 없음 |
| 10인 초과 조직 | Business 또는 Enterprise 플랜만 가능 | 에이전트 로컬 실행 시 platform credits가 소비됨 (Warp 인프라 비용 할인율 적용), 추론 비용은 엔드포인트 제공업체에 별도 결제 |
공용 HTTPS 주소. 이는 Warp의 요구사항으로 간과하기 쉽습니다. 엔드포인트에 대한 요청은 로컬 머신의 앱이 아니라 Warp 서버에서 전송되므로 주소는 인터넷에서 접근 가능해야 합니다. localhost, 127.0.0.1 및 사설망 주소는 폼에서 거부되며, 스킴은 https://만 허용됩니다. JoinGonka Gateway는 공용 HTTPS 서비스이므로 Warp 문서에서 로컬 모델을 위해 권장하는 ngrok 같은 터널은 필요하지 않습니다.
최신 앱 버전. 자체 엔드포인트는 2026년 5월 20일 릴리스부터 안정 버전의 일부로 포함되었으며, 폼 내 API 스키마 선택 기능은 2026년 7월 31일 릴리스에서 추가되었습니다. 폼에 API schema 필드가 없다면 Warp를 업데이트하세요.
연결: Add custom endpoint 폼
모든 설정은 앱 인터페이스에서 이루어집니다. 파일을 직접 편집할 필요가 없습니다.
- Settings를 열고 설정 검색에서
inference endpoint를 입력하세요. Warp가 프로바이더 키와 자체 엔드포인트 블록으로 이동합니다(Warp Agent 설정 페이지에 있습니다). - Add custom endpoint를 클릭하면 양식이 열립니다.
- 표의 값으로 필드를 채우고 Add endpoint를 클릭하세요.
| 양식 필드 | 입력할 값 | 설명 |
|---|---|---|
| API schema | OpenAI Chat Completions | 기본 스키마입니다. Warp 문서가 주소 형식을 설명하는 대상이 바로 이 스키마입니다. 목록에는 OpenAI Responses와 Anthropic Messages도 있습니다 |
| Endpoint name | JoinGonka | 임의의 이름입니다. 이 이름으로 설정에서 엔드포인트가 표시됩니다 |
| Endpoint URL | https://gate.joingonka.ai/v1 | /v1을 포함한 기본 주소입니다. Warp 문서의 예시와 동일합니다 |
| API key | jg-your-key | 기기의 시스템 키 저장소에만 보관됩니다 |
| Model name | deepseek-ai/DeepSeek-V4-Flash-0731 | 게이트웨이가 반환하는 정확한 모델 식별자입니다 |
| Model alias (optional) | DeepSeek V4 Flash | 모델 전환용 짧은 이름입니다 |
+ Add model 버튼으로 다음 행을 추가할 수 있습니다. 설정으로 돌아가지 않고 전환할 수 있도록 네트워크의 모든 모델을 미리 등록해 두세요: deepseek-ai/DeepSeek-V4-Flash-0731, MiniMaxAI/MiniMax-M2.7, zai-org/GLM-5.3-Flash. 최신 목록은 항상 GET https://gate.joingonka.ai/v1/models로 확인할 수 있습니다. 식별자는 한 글자도 틀리지 않게 입력하세요. 양식은 주소 형식과 필드 입력 여부만 검사하며, 저장 시 테스트 요청을 보내지 않습니다. 따라서 모델 이름의 오타는 에이전트와의 대화에서야 드러납니다.
저장 후 모델은 에이전트의 모델 전환기에 나타납니다. 기본 모델이 Warp 모델 중 하나로 남아 있었다면 앱이 변경을 제안할 수 있습니다. 수락하고 자신의 엔드포인트 모델을 선택하세요. 중요한 점: 전환기의 Auto 옵션은 항상 Warp 인프라에서 작동하며, 자체 엔드포인트가 설정되어 있어도 Warp 크레딧을 소모합니다. 요청을 게이트웨이로 보내려면 전환기에서 본인 목록의 특정 모델을 선택해야 합니다.
확인: 게이트웨이를 통해 요청이 가고 있는지 확인하는 방법
전환 스위치에서 내 엔드포인트의 모델을 선택하고 에이전트에게 짧은 작업을 맡겨 보세요. 예를 들어 "현재 디렉터리에서 가장 큰 파일 다섯 개를 보여주고 그 명령어를 설명해줘" 같은 식입니다. 에이전트는 명령어를 제안하고, 여러분의 승인을 받아 실행한 뒤 출력에 대해 코멘트를 달아야 합니다.
이제 게이트웨이 관리 화면에서 '사용량' 섹션을 열어 보세요. '키별' 블록에서 Warp용으로 발급한 키에 요청 수와 마지막 접근 시간이 표시되고, '모델별' 블록에서는 선택한 모델이 나타납니다. 카운터가 올라간다면 Warp 크레딧이 아니라 JoinGonka Gateway를 통해 추론이 이루어지고 있다는 뜻입니다. Warp 쪽에서는 에이전트와의 대화창에 토큰 사용량이 바로 표시됩니다. alias 필드에 지정한 짧은 이름으로 확인할 수 있습니다.
뭔가 잘못됐다면 원인은 대개 응답에서 바로 읽힙니다:
| 보이는 것 | 의미 | 할 일 |
|---|---|---|
401, Invalid API key | 게이트웨이가 키를 인식하지 못함 | 키가 jg-로 시작하는지, 공백 없이 붙여넣었는지, 'API 키' 섹션에서 활성 상태인지 확인하세요. 확실하지 않으면 새로 만드는 게 좋습니다 |
404, Invalid URL (POST …) | 경로에 불필요한 세그먼트가 붙었습니다. 오류 메시지에서 게이트웨이가 어디로 요청을 받았는지 확인할 수 있습니다 | /v1/chat/completions가 되어야 합니다. /v1이 중복됐거나 주소에 전체 경로가 들어갔는지 확인하고, Endpoint URL을 위 표의 형태로 맞추세요 |
405 Not Allowed 또는 응답 대신 HTML 페이지 | 주소에 /v1이 빠져서 요청이 API 바깥으로 나갔습니다 | 주소 끝에 /v1을 추가하세요 |
429 | 모델 과부하: 피크 시간대에는 네트워크 내 특정 모델의 용량이 전부 소진될 수 있습니다 | 몇 초 후 다시 시도하거나 옆 모델로 전환하세요. 그래서 모든 모델을 처음부터 등록해 두는 겁니다 |
| 요청은 통과하는데 Warp 크레딧이 줄어듦 | 전환 스위치에서 엔드포인트 모델이 아니라 Auto 또는 Warp의 모델 라우터가 선택되어 있음 | 내 목록에서 특정 모델을 선택하세요 |
| 폼이 주소를 받지 않음 | Warp는 https://와 공개 호스트를 요구합니다 | https://로 시작하는 게이트웨이 주소 전체를 입력하세요 |
| 모델이 첨부한 이미지를 '보지' 못함 | 네트워크의 모델은 텍스트 전용입니다. 게이트웨이가 이미지를 텍스트 표시로 대체합니다 | 스크린샷 작업에는 비전 모델로 전환하고, 명령어와 코드에는 네트워크 모델을 그대로 사용하세요 |
| 클라우드 실행 시 엔드포인트 모델이 없음 | 내 엔드포인트는 로컬에 저장되며 Cloud Agents에는 적용되지 않습니다 | 로컬 에이전트로 작업을 실행하세요 |
세션의 첫 응답은 몇 초 지연될 수 있습니다. 에이전트가 도구 설명이 담긴 큰 시스템 프롬프트를 보내고, 요청이 먼저 Warp 서버를 거친 다음 네트워크 노드에 도달하기 때문입니다. 그 이후에는 대화가 더 빨라집니다.
터미널 에이전트를 위한 최적의 모델 선택 방법
네트워크 내 모델들의 가격은 동일하므로, 선택 기준은 예산이 아닌 동작 방식입니다. 터미널 에이전트는 많은 정보를 읽고(명령어 출력, 로그, 파일), 도구를 지속적으로 호출합니다. 표에 나열된 모든 모델은 네이티브 tool calling을 지원합니다.
| 모델 | 식별자 | 컨텍스트 및 응답 | Warp에서 선택 시기 |
|---|---|---|---|
| DeepSeek V4 Flash | deepseek-ai/DeepSeek-V4-Flash-0731 | 380K, 응답 최대 32768 토큰 | 에이전트 기본 모델: 긴 세션, 대용량 로그 및 diff, 여러 파일 수정. 컨텍스트 여유가 많고 네트워크 내에서 가장 큰 응답 제한 제공 |
| MiniMax M2.7 | MiniMaxAI/MiniMax-M2.7 | 200K, 응답 최대 8192 토큰 | 빠르고 짧은 작업: 명령어 추천, 오류 분석, 설정 수정 |
| GLM-5.3 Flash | zai-org/GLM-5.3-Flash | 390K, 응답 최대 8192 토큰 | 추론 모델: 답변 전 논리적 사고 수행. 복잡한 디버깅, 마이그레이션 계획, 익숙하지 않은 코드 분석; 응답이 다소 늦고 응답 제한의 일부가 추론 과정에 소요됨 |
실용적인 구성: 기본 모델로 DeepSeek V4 Flash를, 간단한 작업에는 MiniMax M2.7을, 논리적 해결이 필요한 경우에는 GLM-5.3 Flash를 사용합니다. 모든 모델은 이미 endpoint에 등록되어 있으며, alias 필드의 짧은 이름을 통해 긴 식별자를 혼동하지 않고 1초 만에 전환할 수 있습니다. 가장 대중적인 모델에 대한 자세한 내용은 DeepSeek V4 Flash 개요를 참조하세요.
비용 정보
터미널 에이전트는 일반 채팅보다 토큰 소비량이 많습니다. Warp는 각 요청에 시스템 지침, 대화 컨텍스트, 도구 설명을 추가하며, 하나의 작업이 여러 단계로 구성되기 때문입니다. 따라서 여기서는 토큰당 가격이 일반 채팅보다 더 중요합니다.
JoinGonka Gateway를 통한 토큰 가격은 입력 100만 토큰당 $0.0069, 출력 100만 토큰당 $0.021이며, 네트워크 내 모든 모델에 대해 동일하게 적용되고 이 페이지에서는 실시간 소스에서 가져옵니다. 2026년 9월 기준 예상 비용은 다음과 같습니다:
| 시나리오 | 소비량 | Gateway 이용 시 |
|---|---|---|
| 일회성 작업: 명령어 및 출력 분석 | 수만 토큰 | 1센트 미만 |
| 에이전트와 활발히 작업하는 하루 | 3-7M 토큰 | 몇 센트 |
| 매일 작업하는 한 달 | ~150M 토큰 | 1-2달러 정도 |
비교를 위해 Warp 에이전트 결제 방식 3가지를 소개합니다:
| 방식 | 추론 계산 주체 | 제한 사항 |
|---|---|---|
| Warp 모델 | Warp (플랜 크레딧) | 플랜의 월간 크레딧 잔액 |
| BYOK: OpenAI, Anthropic, Google 키 | 모델 벤더 (각 가격 정책) | 벤더의 100만 토큰당 가격 |
| 자체 endpoint + JoinGonka Gateway | 게이트웨이: 토큰 기반 (잔액 차감) | 잔액만 고려: 관리자 페이지에서 소비량 확인 가능, 요청 횟수 제한 없음 |
Warp 자체는 개인 및 10인 이하 팀의 경우 자체 endpoint를 통한 작업에 대해 크레딧을 차감하지 않으며, 게이트웨이의 토큰 비용만 지불하면 됩니다. 잔액은 관리자 페이지에서 충전할 수 있으며, 일별 잔액 및 모델별 소비량도 확인할 수 있습니다.
요청 경로 및 개인정보 보호: 중요 사항
대부분의 도구에서 커스텀 endpoint는 "내 컴퓨터에서 프로바이더로 직접 요청이 이동함"을 의미하지만, Warp는 다릅니다. Warp 에이전트의 실행 부분은 Warp 서버에서 작동하므로 커스텀 endpoint는 최종 목적지와 키만 변경합니다. Warp 문서에 따른 요청 경로는 다음과 같습니다:
- 애플리케이션이 디바이스의 보안 저장소에서 endpoint 주소와 키를 가져와 프롬프트와 함께 Warp 서버로 전송합니다.
- Warp 측 에이전트가 시스템 지침, 대화 컨텍스트, 도구 등을 포함한 전체 요청을 구성하여 해당 키로 귀하의 endpoint를 호출합니다.
- 응답은 동일한 서버를 거쳐 스트림 형태로 애플리케이션으로 돌아옵니다.
실무적인 의미는 다음과 같습니다:
- 키: 디바이스에만 저장됩니다. 요청할 때마다 Warp 서버를 거치지만, Warp의 성명에 따르면 서버에 저장되지 않고 즉시 사용 후 폐기됩니다.
- 프롬프트 및 응답: Warp 백엔드를 경유합니다. Warp는 이를 학습에 사용하지 않는다고 밝히고 있으며, 저장 및 분석은 계정의 개인정보 보호 및 텔레메트리 설정에 따릅니다. Warp 자체 모델에 적용되는 ZDR 보증을 커스텀 endpoint에는 확장할 수 없습니다. 무엇을 저장할지는 프로바이더가 결정합니다.
- 게이트웨이 측: JoinGonka Gateway는 대화를 저장하지 않습니다. 응답 후 프롬프트와 답변은 게이트웨이에 남지 않으며, 관리 페이지에는 요청 수와 토큰 카운터만 보입니다.
- Warp 인프라에 남는 것: Auto 옵션, 커스텀 모델 라우터, Codebase Context, Active AI 힌트 및 클라우드 에이전트는 커스텀 endpoint의 영향을 받지 않습니다.
업무상 타사 서버를 거치는 경로가 허용되지 않는다면, 내 컴퓨터에서 endpoint로 직접 연결되는 에이전트(예: Codex CLI 또는 API 퀵스타트의 도구)를 사용하세요. Warp는 발표에서 클라이언트 전용 옵션도 약속했습니다. 이는 Warp 서버를 거치지 않고 로컬 모델에 연결되는 Rust 기반의 경량 에이전트 모듈을 오픈 레포지토리로 제공하고 Agent Client Protocol을 지원하는 것입니다. 또한 2026년 9월 2일 릴리스부터는 endpoint 설명이 애플리케이션과 Warp Agent CLI에서 공통으로 사용하는 형식의 구성 파일에 저장되며, 키는 파일에 기록되지 않고 보안 저장소에 그대로 남습니다.