LLM Gateway: 통합 LLM API 연결과 비용 관리

여러 모델의 API 연결, 요청 라우팅과 비용 분석

llmgateway.io
LLM Gateway screenshot

LLM Gateway는 여러 언어 모델 제공업체를 하나의 API로 연결하는 오픈 소스 LLM 게이트웨이입니다. 요청 라우팅, 키 관리, 사용량 분석을 모아 주므로 모델마다 별도 SDK와 결제 대시보드를 관리하던 개발팀이 호출 경로와 비용을 함께 살펴볼 수 있습니다.

LLM Gateway는 어디에 쓰나요? 쉬운 예시

고객 지원 앱이 한 모델로 문의를 분류하고 다른 모델로 답변을 작성한다고 생각해 보세요. 앱은 LLM Gateway에 요청을 보내고, 게이트웨이는 제공업체에 전달한 뒤 결과를 돌려줍니다. 이 중간 지점에서 호출 비용과 지연 시간도 확인할 수 있습니다.

자체적으로 답을 만드는 새 모델이 아니라 모델 사용을 연결하는 인프라입니다. 운영사는 Polar Lights LLC이며, 주된 대상은 앱 개발자와 플랫폼 팀입니다. 별도 Lounge 화면에서는 브라우저로 모델을 시험할 수 있습니다.

첫 API 요청을 보내고 결과 확인하기

공식 빠른 시작 문서를 따라 진행합니다.

  1. 대시보드에 로그인하고 프로젝트를 만든 뒤 게이트웨이 API 키를 발급받습니다. 키는 서버 환경에 보관합니다.
  2. 선불 크레딧을 쓰거나 Provider Keys에 자신의 제공업체 키를 추가합니다. 게이트웨이 키는 앱을 인증하고, 제공업체 키는 해당 서비스 계정에 연결합니다.
  3. 현재 사용 가능한 모델 ID를 고르고 입력 형식, 기능, 컨텍스트 한도를 확인합니다.
  4. OpenAI 호환 클라이언트의 기본 주소를 https://api.llmgateway.io/v1로 설정합니다. HTTP 요청은 /chat/completionsmodelmessages를 보내고 Bearer 인증을 사용합니다.
  5. 반환 메시지를 확인한 다음 대시보드의 제공업체, 토큰, 지연 시간, 비용을 대조합니다.

실제 트래픽을 옮기기 전에 대표적인 업무 입력으로 시험하세요. API 호환성이 모든 모델의 도구와 매개변수까지 같다는 의미는 아닙니다.

모델 전환과 제공업체 장애 대응

공통 API는 작업별 모델 비교를 쉽게 합니다. 라우팅은 사용 가능한 제공업체를 선택하고, 실패한 요청을 다른 적합한 제공업체로 재시도할 수 있습니다. 라우팅 규칙은 상위 서비스의 가용성과 한도에 영향을 받으므로 무중단을 보장하지 않습니다.

분석 화면은 비싼 모델이나 느린 호출을 찾는 데 도움이 됩니다. 키별 사용 한도와 접근 규칙으로 앱을 구분하고 사용할 모델 또는 제공업체를 제한할 수 있습니다. 캐시는 반복 작업을 줄일 수 있지만 게이트웨이 응답 캐시와 제공업체 프롬프트 캐시는 서로 다릅니다. 효과는 설정, 요청 특성, 모델 지원 여부에 달려 있습니다.

무료 사용과 실제 청구 비용 구분하기

2026년 9월 10일 확인 기준, 표준 호스팅 서비스의 BYOK 라우팅에는 플랫폼 요금이 없으며 추론 비용은 제공업체에 직접 지불합니다. 크레딧 구매 시 공식 FAQ가 안내하는 수수료는 5%입니다. 전체 요청 내용을 선택적으로 저장하면 백만 토큰당 0.01달러가 추가됩니다. 미국 외 카드에는 1.5% 국제 수수료도 표시되며 Enterprise는 개별 견적입니다.

최신 가격을 확인하고 입력·출력 토큰을 나눠 계산하세요. 무료 계정이 모든 모델의 무료 이용을 뜻하지는 않습니다. DevPass와 채팅 구독은 별도 조건입니다. 달러 표기는 한국 원화 최종 가격이나 모든 국내 결제 수단의 지원을 확인해 주는 정보가 아닙니다.

직접 호스팅할 때 달라지는 점

자체 호스팅 가이드는 Docker, Compose, Kubernetes를 다룹니다. 앱 서비스, PostgreSQL, Redis, 제공업체 인증 정보가 필요하며 운영, 백업, 업데이트, 권한 관리를 팀이 맡습니다.

게이트웨이 코드는 AGPLv3이고 ee/의 기업 기능에는 별도 상용 라이선스가 적용됩니다. 인프라 통제가 필요하고 운영 역량이 있는 팀에 맞는 방식입니다. 게이트웨이를 직접 설치한다고 외부 모델까지 로컬에서 실행되지는 않습니다. 외부 제공업체로 보낸 요청은 그곳에서 처리됩니다.

데이터 보관과 호출 한도 확인하기

기본적으로 메타데이터만 저장하며 표준 조직은 전체 내용 보관을 선택할 수 있습니다. Responses API에는 예외가 있습니다. 저장된 응답은 조직 설정과 별개로 30일간 보관되며 store: false로 이 저장을 끌 수 있습니다. 사용하는 엔드포인트에 맞게 보관 규칙을 확인하세요.

개인정보 정책은 게이트웨이가 고객 콘텐츠로 모델을 학습하지 않는다고 설명합니다. 선택한 제공업체는 자체 정책을 적용합니다. 조직·동시 요청·제공업체 한도도 존재하고 무료 모델 할당량은 크레딧 상태에 따라 달라집니다. 429 오류에 대비해 대기와 동시 호출 수 제어를 마련하세요.

자주 묻는 질문

무료로 사용할 수 있나요?

BYOK 라우팅은 무료지만 제공업체의 추론 요금은 별도입니다. 크레딧과 선택적 전체 저장에도 비용이 있습니다.

기존 OpenAI 연동을 유지할 수 있나요?

호환 API에 새 기본 주소, 게이트웨이 키, 지원 모델 ID를 설정할 수 있습니다. 모델별 기능을 먼저 시험하세요.

자체 호스팅이면 모든 처리가 내부에 남나요?

아닙니다. 직접 호스팅하는 것은 게이트웨이이며 외부 모델은 제공업체에서 요청을 처리합니다.

프롬프트는 전혀 저장되지 않나요?

모든 API에 적용되는 설명은 아닙니다. Responses API에는 30일 보관 규칙과 store: false 설정이 있습니다.

공식 자료와 개발자 커뮤니티