가이드 목록으로
가격·2026년 9월 21일·최종 업데이트 2026년 10월 3일·12분 분량

LibreChat 가격 및 API 비용 — 소프트웨어 비용과 토큰 비용

MIT 소프트웨어, 404 가격 페이지, 그리고 포함된 표를 기준으로 트래픽 가격을 계산하는 비용 표시.

마지막 검토일: .

LibreChat은 비용이 들지 않습니다. MIT 라이선스 소프트웨어이며 요금제, 좌석 또는 가격 페이지가 전혀 없습니다. 이 페이지를 확인한 2026년 9월 19일에 librechat.ai/pricing은 HTTP 404를 반환했습니다. 운영자가 예산을 책정하는 것은 세 가지입니다. 실행할 장소, 전송하는 모델 API 토큰, 선택적 부가 서비스입니다. 청구서를 결정하는 것은 토큰이며, 함정은 LibreChat이 표시하는 달러 금액이 공급업체가 실제로 청구한 금액이 아니라 함께 제공되는 표를 기준으로 책정된다는 점입니다.

세 가지 항목이 LibreChat의 가격으로 오인됩니다. 첫째는 팀이 한때 판매했던 별도 서비스인 Code Interpreter API이며, 현재 상점에는 "Subscriptions Currently Unavailable"라고 표시되고 금액은 공개되어 있지 않습니다. 둘째는 제3자가 판매하는 관리형 호스팅으로, 해당 공급업체의 호스팅 요금입니다. 셋째는 완전히 다른 프로젝트인 PyPI의 libre-chat입니다. 이는 Vincent Emonet이 만든 휴면 Python 챗봇으로, 마지막 릴리스 0.0.6은 2024년 1월 9일에 업로드되었습니다. 해당 문서로는 이 프로젝트를 구성할 수 없습니다. LibreChat을 요금제 등급이나 견적 양식과 함께 소개하는 디렉터리 사이트는 프로젝트가 판매하지 않는 요금제를 설명하는 것입니다.

이미 인스턴스를 실행 중인가요? Gateway 구성 및 결제 확인으로 이동하거나 전용 LibreChat 설정 가이드를 사용하세요.

LibreChat 가격, 항목별 설명

항목비용출처
LibreChat 자체$0, MITmain의 LICENSE 및 About 페이지
호스팅된 LibreChat 요금제존재하지 않음/pricing은 404이며 사이트 내비게이션에는 가격, 클라우드 또는 엔터프라이즈 링크가 없습니다
Code Interpreter API(유일한 유료 제품)신규 구독자에게 폐쇄됨. 공개된 가격 없음code.librechat.ai/pricing
Code Interpreter, 자체 호스팅 대체 제품소프트웨어 비용 $0, Apache-2.0. 컴퓨팅 비용은 사용자가 부담LibreChat-AI/code-interpreter
관리자 패널$0, AGPL-3.0LibreChat-AI/admin-panel
Agents API(베타)$0. 자체 인스턴스의 기능Agents API 문서 — remoteAgents 뒤에서 제한되며, 문서에는 권한 기본값이 false이고 관리자 사용자는 예외라고 나와 있습니다
모델 API 토큰제공자의 토큰당 요금제공자 자체 청구
실행할 장소호스트의 가격LibreChat은 RAM, vCPU 또는 디스크 최소 사양과 예시 청구 금액을 공개하지 않습니다
제3자 관리형 이미지시간당 $0.05의 소프트웨어 요금과 AWS 인프라 비용Cloud Infrastructure Services의 AWS Marketplace 등록

프로젝트를 기준으로 계획을 세우기 전에 한 가지 정정할 사항이 있습니다. LibreChat은 ClickHouse에 인수되었으며, 2025년 11월 4일에 발표되었습니다. 해당 게시물은 MIT 라이선스를 유지하겠다고 약속하고 기존 배포에는 영향이 없다고 말합니다. 저장소는 변경되지 않았고 활성 상태입니다. 보관되지 않았으며 MIT 라이선스이고, GitHub API에 따르면 마지막 푸시는 2026년 9월 21일입니다. 재배포한다면 스택 전반의 라이선스가 서로 다르다는 점이 중요합니다. 앱과 RAG API는 MIT, code-interpreter 서비스는 Apache-2.0, Admin Panel은 AGPL-3.0입니다. 라이선스가 핵심이라면 직접 확인해야 할 불일치도 있습니다. LICENSE 파일과 About 페이지는 모두 MIT라고 하지만 main 브랜치의 package.json은 ISC를 선언합니다. 두 쪽의 내용이 서로 다르며, 적용되는 라이선스를 정하는 문서는 LICENSE 파일입니다. ClickHouse가 현재 유료 LibreChat 제품을 판매하는지는 이 페이지에서 어느 쪽으로도 확인할 수 없었습니다.

버전 고정과 관련해 알아둘 특이점이 하나 있습니다. 이 저장소의 모든 GitHub 릴리스 객체가 prerelease로 표시되므로 "latest release" 엔드포인트는 아무것도 반환하지 않습니다. 최신 태그는 2026년 9월 15일의 v0.8.8-rc3이고, 최신 비-rc 태그는 2026년 6월 24일의 v0.8.7입니다.

LibreChat이 표시하는 비용은 실제로 지불한 비용이 아닙니다

가격 페이지가 알려줄 수 없는 부분이며, 게이트웨이 사용자의 원장이 잔액과 전혀 맞지 않게 되는 이유이기도 합니다. LibreChat은 자체 내부 통화를 사용합니다. 토큰 사용량 문서는 1,000,000크레딧을 미화 1달러로 고정합니다. 직접 요금을 재정의하지 않으면 각 요청은 LibreChat이 자체적으로 조회한 요율을 사용해 크레딧으로 변환됩니다.

해당 조회는 부분 문자열 일치입니다. packages/api/src/utils/tokens.ts의 주석은 규칙을 명확히 설명합니다. 매처는 가격표에서 모델 이름에 포함되는 가장 긴 키를 선택합니다. 또한 packages/data-schemas/src/methods/tx.ts의 표에는 공급업체 목록 요금이 들어 있습니다. 이 둘을 합치면 게이트웨이 모델 ID는 그 안에 부분 문자열로 포함된 더 짧은 키의 가격으로 책정됩니다.

전송하는 모델 IDKunavo 카탈로그, 1M당 입력/출력일치하는 표 키원장에서 차감되는 금액, 1M당 입력/출력
claude-haiku-4-5$0.70 / $3.50claude-haiku-4-5$1.00 / $5.00
gpt-5-6-terra$0.70 / $4.20gpt-5$1.25 / $10.00
claude-sonnet-4-6$2.10 / $10.50claude-sonnet-4-6$3.00 / $15.00
claude-sonnet-5$1.40 / $7.00claude-sonnet-5$2.00 / $10.00

왼쪽 열은 실시간 Kunavo 카탈로그이고 오른쪽 열은 2026년 9월 19일 main에서 읽은 LibreChat 자체 상수입니다. 세 가지 경우가 있습니다. claude-sonnet-5는 자기 자신과 일치하고 양쪽 요금이 같으므로 잘못된 점이 없어 보입니다. 그래서 알아차리기 어렵습니다. claude-sonnet-4-6도 자기 자신과 일치하지만 카탈로그 요금이 아니라 공급업체 목록 요금으로 책정됩니다. 그리고 gpt-5-6-terra는 자체 항목이 없습니다. 포함하는 가장 긴 표 키가 gpt-5이므로 원장은 해당 모델로 청구합니다.

아무것도 일치하지 않으면 소스는 토큰당 6크레딧이라는 고정 대체 요금을 입력과 출력에 동일하게 적용합니다. 양방향 모두 100만 토큰당 $6이며, 위 표의 모든 모델 입력 요금보다 훨씬 높습니다. 어느 경우든 해결 방법은 같습니다. 사용자 지정 엔드포인트 아래에 tokenConfig 블록을 선언하세요. 코드는 자체 표를 조회하기 전에 이 재정의를 확인하며, 주석에도 그렇게 적혀 있습니다. 요금은 USD/100만 토큰으로 입력하고 모델마다 prompt, completion, context를 모두 지정해야 합니다.

잔액 문서에서 확인되는 관련 기본값 두 가지는 다음과 같습니다. balance.enabled를 설정하기 전까지 지출 한도는 꺼져 있으며, 활성화하면 신규 사용자는 20,000크레딧으로 시작합니다. 이는 LibreChat 자체 환산 기준으로 2센트입니다. 자동 충전은 별도로 꺼져 있고, 기본값은 30일마다 10,000크레딧입니다. 같은 구성 참조의 인접 페이지에서 두 가지를 더 확인할 수 있습니다. interface.contextCost를 활성화하기 전까지 비용 수치는 사용자에게 숨겨지며 기본값은 false입니다. 또한 transactions 페이지에는 잔액을 켜면 transactions.enabled 설정과 관계없이 거래 기록이 활성화된다고 나와 있습니다.

LibreChat에 가장 적합한 API: 어떤 경우에 어떤 경로가 유리한가

경로유리한 경우포기해야 하는 것
공급자 직접 API모두 한 공급업체를 사용하고 해당 공급업체의 자체 캐싱 및 배치 할인을 원하는 경우두 번째 공급업체를 사용하면 두 번째 키와 두 번째 사용자 지정 엔드포인트 블록이 필요합니다
하나의 게이트웨이, 하나의 사용자 지정 엔드포인트선택기에 여러 공급업체를 하나의 키와 하나의 잔액으로 담아야 하는 경우모델 ID가 LibreChat 가격표의 잘못된 행으로 해석될 수 있으므로 tokenConfig는 한 번 수동으로 설정해야 합니다
Google의 무료 등급비용을 0으로 유지해야 하는 개인 또는 평가용 인스턴스Google의 가격 페이지에는 무료 등급 데이터가 제품 개선에 사용된다고 나와 있으며, 유료 등급에는 그렇지 않다고 나와 있습니다
사용자별 BYOK각 사용자가 자신의 사용량을 부담해야 하는 경우apiKey 또는 baseURL을 리터럴 user_provided로 설정하세요. 사용자가 제공한 baseURL을 사용하면 LibreChat은 구성된 헤더 템플릿을 전달하지 않습니다
로컬 모델요청별 요금이 없는 비공개 또는 중요도가 낮은 작업호스팅된 최첨단 모델과의 기능 격차가 있으며, 하드웨어는 직접 실행해야 합니다
소비자용 채팅 구독이 목적에는 절대 불가능합니다LibreChat에는 API 키가 필요합니다. 연간 결제 시 월 $17, 월별 결제 시 $20인 Claude Pro 좌석은 LibreChat에 연결되지 않습니다

예산 기준을 위해 2026년 9월 19일 확인한 공급업체 요금: Anthropic은 Claude Sonnet 5를 100만 토큰당 입력 $2, 출력 $10으로 제시하며, $2/$10 요금이 현재 표준이고 예정된 인상은 발생하지 않는다는 설명을 덧붙였습니다. OpenAI는 표준 요금표의 짧은 컨텍스트 열에서 100만 토큰당 입력/출력 요금을 gpt-5는 $1.25/$10, gpt-5-nano는 $0.05/$0.40으로 제시합니다. Google은 Gemini 3.8 Flash 유료 요금을 2026년 12월 31일까지 100만 토큰당 입력 $0.75, 출력 $3.75로 제시하며, 이후에는 입력/출력 요금이 $1.50/$7.50으로 인상됩니다. 그 위에는 실제 무료 등급이 있습니다. Claude 구독 가격도 같은 확인에서 가져왔습니다. ChatGPT 구독 가격은 의도적으로 제외했습니다. 확인일에 openai.com이 모든 자동화된 요청에 403을 반환했으며, 검증되지 않은 금액은 예산에 포함할 수 없습니다.

LibreChat에 가장 저렴한 API

호스팅된 API 중 가장 저렴하게 표시된 옵션은 게이트웨이도 할인도 아닙니다. Google의 Gemini Developer API 무료 등급입니다. Gemini 3.8 Flash의 입력·출력·컨텍스트 캐싱에 요금이 없으며, 같은 페이지에는 무료 등급 데이터는 Google 제품 개선에 사용되고 유료 등급에서는 그렇지 않다는 조건이 명시되어 있습니다. Google Search를 사용한 그라운딩은 별도로 측정되며, Gemini 3.x 모델 전체에서 월 5,000건의 무료 요청을 공유하고 이후에는 1,000건당 $14입니다. 비용을 0으로 유지해야 하고 콘텐츠가 민감하지 않은 개인 LibreChat 인스턴스라면 이것이 정확한 답입니다. 이를 더 낮추는 유일한 방법은 로컬 모델이며, 요청별 요금은 없지만 대신 하드웨어 비용이 듭니다.

그 이후에는 표시된 최저 가격과 작업을 완료하는 최저 비용이 서로 다른 주장입니다. 이 페이지는 절대적인 최저 가격을 약속하지 않습니다. 요약에 세 번 시도해야 하는 소형 모델은 한 번에 끝나는 중간급 모델보다 비쌉니다. LibreChat에서는 그 차이가 두 번 나타납니다. 재시도 자체에서 한 번, 그리고 이후 모든 턴에서 다시 전송할 수 있도록 재시도가 남긴 대화 기록에서 한 번입니다. 요금 비교보다 다음 세 가지 습관이 청구 금액에 더 큰 영향을 줍니다. 제목 요청이 최고급 모델에 도달하지 않도록 저렴한 titleModel를 고정하세요. 기본 모델 목록을 짧게 유지하여 호기심 때문에 아무도 비싼 모델을 선택하지 않게 하세요. 그리고 tokenConfig를 선언하여 최적화 기준이 LibreChat의 내장 표가 아니라 자신의 요금이 되도록 하세요. 같은 내용에 대한 더 자세한 설명은 AI 비용 최적화에서 확인할 수 있습니다.

LibreChat 인스턴스 하나의 월간 예산 예시

이는 측정된 비용이나 청구 한도가 아닌 예시 토큰 산술입니다. LibreChat 사용자가 한 달에 소비하는 양에 대해 공개된 수치는 없으므로, 아래 형태는 자신의 대화 기록 양으로 대체해야 할 가정입니다. 활성 사용자 한 명이 한 달에 120회 대화를 보내고, 각 대화에 누적 기록으로 입력 토큰 8,000개가 포함되며 출력 토큰 700개를 반환한다고 가정합니다. 이는 입력 960k 토큰과 출력 84k 토큰입니다. 요금은 실시간 Kunavo 카탈로그 가격입니다.

모델1M당 입력 / 출력예상치, 사용자 1명/월예상치, 사용자 50명/월
Claude Haiku 4.5$0.70 / $3.50$0.97$48.30
GPT-5.6 Terra$0.70 / $4.20$1.02$51.24
Claude Sonnet 4.6$2.10 / $10.50$2.90$144.90
Claude Sonnet 5$1.40 / $7.00$1.93$96.60

대화 제목은 대부분의 예산에서 빠뜨리는 별도 항목입니다. titleConvo가 켜져 있으면 LibreChat은 각 제목을 생성하기 위해 자체 요청을 보내고, titleModel가 어떤 모델이 응답할지 결정합니다. 사용자당 월 40개의 새 대화가 있고 각 대화에 입력 토큰 1,200개와 출력 토큰 30개가 사용된다고 가정하면, 50명의 사용자는 $3.78를 Claude Sonnet 5에서 사용하고, $1.89를 Claude Haiku 4.5에서 사용합니다. 저렴한 제목 모델을 고정하는 것은 YAML 한 줄이면 됩니다.

그리고 위 섹션의 회계 차이도 같은 단위로 살펴보겠습니다. 해당 월이 GPT-5.6 Terra에서 실행되며 카탈로그 예상 비용이 사용자당 $1.02라고 가정하세요. tokenConfig 블록이 없으면 LibreChat은 ID를 gpt-5 항목과 일치시켜 내부 잔액에서 대신 $2.04를 차감합니다. ID가 아무것과도 일치하지 않았다면 대체 요금으로 동일한 1.044백만 토큰에 대해 $6.26가 차감됩니다. 구성되지 않은 원장에서 설정한 잔액은 사용자가 실제로 지출했다고 생각하는 금액보다 훨씬 일찍 사용자를 차단합니다.

Kunavo의 카탈로그 금액은 상한이 아니라 청구 하한입니다. 업스트림이 요금을 보고하면 청구 금액은 카탈로그 비용과 해당 마크업이 적용된 업스트림 비용 중 더 큰 금액입니다. 캐시 요금과 아래의 부가 서비스는 이 예시에 포함되지 않습니다. 최소 충전액은 선불 크레딧 $10이며, 이는 요금제를 구매하는 것이 아니라 잔액을 충전합니다. 청구 세부 정보를 참조하세요.

LibreChat에 가장 적합한 모델: 엔드포인트가 도달해야 하는 대상에 따라 선택

이에 대한 공식 답변은 없으며, 순위를 제시하는 페이지는 의견을 제시하는 것입니다. LibreChat이 공개하는 것은 제약 조건 목록입니다. 2026년 6월 18일에 마지막으로 검토된 호환성 매트릭스는 사용자 지정 OpenAI 호환 엔드포인트가 스트리밍, 웹 검색, 코드 인터프리터, 아티팩트, 파일 검색, OCR 및 메모리를 지원한다고 표시합니다. 도구·함수 호출 및 비전은 모델에 따라 달라지는 것으로 표시되고, 이미지 생성과 MCP는 일반 채팅 대화가 아니라 Agents 엔드포인트를 통해서만 사용할 수 있습니다.

그러면 모델 선택은 구체적인 세 가지 질문으로 바뀝니다. 사람들이 Agents 또는 MCP 도구를 실행할 예정이라면 모델이 도구를 안정적으로 호출해야 하므로, 가장 저렴한 등급이 자동으로 사용할 수 있는 것은 아닙니다. 스크린샷이나 PDF를 붙여 넣을 예정이라면 비전 기능이 필요합니다. 어느 쪽도 해당하지 않는 경우, 즉 주로 초안 작성과 Q&A에 사용하는 인스턴스라면 중간 등급 모델로 충분하며 플래그십 모델은 선택 사항입니다. 단정적인 결론이 아니라 근거를 함께 제시하는 저희의 권장 방식은 models.default에 강력한 모델 하나와 저렴한 모델 하나를 넣고, 저렴한 모델을 titleModel로 고정한 다음 사용자가 전환할 수 있게 하는 것입니다. 합리적인 두 가지 옵션이 있는 선택기가 시간이 지나 낡는 순위표보다 낫습니다.

모델 엔드포인트를 거치지 않는 항목

LibreChat의 네 가지 기능은 모델 기능처럼 보이지만 실제로는 전혀 다른 곳에서 비용이 청구됩니다. 이를 모델 API 지출의 일부로 예산에 포함하면 엔드포인트가 청구할 금액은 과대평가하고 총비용은 과소평가하게 됩니다.

기능비용을 청구하는 주체구성 방식
코드 인터프리터직접 실행하는 샌드박스 서비스 또는 해당 컴퓨팅 리소스LIBRECHAT_CODE_BASEURL와 JWT 인증 또는 LIBRECHAT_CODE_API_KEY
웹 검색별도의 검색·스크래핑·재순위화 업체검색에는 Serper, SearXNG, Tavily 또는 키가 필요 없는 Keenable을 사용하고, 가져오기에는 Firecrawl, Tavily 또는 Keenable을 사용하며, 재순위화에는 Jina 또는 Cohere를 사용하거나 아무것도 사용하지 않습니다.
OCR자체 키와 기본 URL을 사용하는 OCR 업체ocr.apiKey 및 ocr.baseURL; 이 기능은 일반 텍스트 파싱으로 대체될 수 있으므로 선택 사항
파일 채팅 임베딩RAG API에 지정한 임베딩 제공업체RAG API 자체의 RAG_OPENAI_API_KEY, RAG_OPENAI_BASEURL 및 EMBEDDINGS_PROVIDER

임베딩에 대해서는 한 가지를 분명히 해야 합니다. Kunavo는 임베딩 모델을 제공하지 않습니다. 따라서 Kunavo가 채팅 트래픽을 처리하더라도 LibreChat의 파일 채팅 단계는 외부 제공업체 또는 로컬 환경에서 실행됩니다. 다른 게이트웨이가 임베딩을 제공하는지는 해당 게이트웨이의 자체 카탈로그에서 확인해야 합니다. 비용을 전혀 들이지 않으려면 RAG API 구성 페이지에 기본 Docker 이미지가 lite 빌드이며 원격 임베딩만 지원한다고 명시되어 있습니다. 로컬 임베딩을 사용하려면 compose 파일에서 이미지를 full 빌드로 교체해야 합니다. 웹 검색에도 무료 경로가 있습니다. Keenable은 검색과 페이지 가져오기 모두에서 키 없이 작동하기 때문입니다. 이 페이지에서는 해당 업체들의 자체 가격을 확인하지 않았으므로 여기에는 어떤 가격도 인용하지 않습니다.

가격을 명시해 게이트웨이 연결하기

아래 내용은 2026년 9월 19일에 확인한 사용자 지정 엔드포인트 스키마를 따릅니다. name, apiKey, baseURL 및 models는 각각 필수이며, 엔드포인트 이름은 고유해야 하고 openAI 또는 anthropic와 같은 기본 제공 이름을 재사용해서는 안 됩니다.

librechat.yaml
# librechat.yaml — a gateway as a custom endpoint, with prices declared.
# Schema version on main is 1.3.16; published examples still show older values.
version: 1.3.16

endpoints:
  custom:
    # The name must be unique and must not reuse a built-in endpoint name.
    - name: "Kunavo"
      apiKey: "${KUNAVO_API_KEY}"
      # LibreChat appends /chat/completions to this unless directEndpoint: true
      baseURL: "https://api.kunavo.com/v1"
      models:
        default: ["claude-sonnet-5", "gpt-5-6-terra", "claude-haiku-4-5"]
        fetch: true                        # populate the picker from GET /models
      titleConvo: true
      titleModel: "claude-haiku-4-5"          # titles do not need a flagship

      # Without this block LibreChat prices your traffic from its own table.
      # prompt/completion are USD per MILLION tokens; context is that model's
      # own window. All three are required for every model you list here.
      tokenConfig:
        claude-sonnet-5:
          prompt: 1.4
          completion: 7
          context: 1000000
        gpt-5-6-terra:
          prompt: 0.7
          completion: 4.2
          context: 1050000

사람들이 자주 놓치는 세 가지가 있습니다. 첫째, LibreChat은 기본적으로 기본 URL 뒤에 /chat/completions를 추가하므로, 기본 URL이 이미 전체 completions 엔드포인트인 경우에만 directEndpoint: true을 설정해야 합니다. 둘째, 게이트웨이에 대해 이전 튜토리얼에서 여전히 권장하는 OPENAI_REVERSE_PROXY는 환경 변수 참조에서 deprecated로 표시되어 있으며, 대신 사용자 지정 엔드포인트를 사용하도록 안내합니다. 셋째, 사용자 지정 엔드포인트는 provider: 'anthropic'를 설정하여 chat completions가 아니라 기본 Anthropic Messages 프로토콜을 사용할 수 있습니다. 현재 지원되는 값은 이것뿐입니다. 이 필드는 태그 v0.8.7의 구성 스키마에는 있지만 v0.8.6에는 없으므로 v0.8.7 이상으로 취급하세요. 이 방식을 사용할 때는 OpenAI 방식의 모델 가져오기가 해당 경로에서 사용되지 않으므로 models.default 아래에 모델을 명시적으로 나열하세요.

Agents 구성에 따라 사용자 지정 엔드포인트 이름을 endpoints.agents.allowedProviders에서도 사용할 수 있으므로, 게이트웨이 기반 모델을 일반 채팅에만 제한하지 않고 LibreChat Agents에서 사용할 수 있습니다.

현재 작동하는 구성을 변경하기 전에 Gateway 마이그레이션 체크리스트를 저장하세요.

설정하기

Kunavo는 OpenAI 호환 엔드포인트와 여러 클라이언트 설정 가이드를 제공하며, 위 YAML은 LibreChat이 문서화한 자체 스키마를 따릅니다. 이는 호환성 테스트가 아니라 구성 참조입니다. 여기서는 LibreChat을 Kunavo 엔드포인트에 대해 런타임 테스트하지 않았으며, 이 페이지의 모든 내용은 실행 중인 인스턴스가 아니라 LibreChat의 소스와 문서에서 확인했습니다. 사용 중인 계정에 기록된 내용과 LibreChat 자체 원장이 말하는 내용을 비교하기 전에 작동하는 경로를 유지하고, 제한된 대화 하나를 전송하세요. 두 숫자의 차이가 바로 tokenConfig 블록의 핵심입니다.

OpenAI 호환 API 가이드와 클라이언트 통합 색인에서 시작하고, 키에 자금을 충전할 준비가 되면 Kunavo 계정을 생성하세요. 아직 인터페이스를 선택 중이라면 LibreChat과 Open WebUI 비교에서 설정의 번거로움을 비교하고, 최고의 LLM 게이트웨이에서는 라우팅 문제를 별도로 다룹니다.

자주 묻는 질문

LibreChat의 비용은 얼마인가요?

없습니다. LibreChat은 MIT 라이선스 소프트웨어이며 요금제, 좌석 또는 구독이 없습니다. librechat.ai/pricing은 HTTP 404를 반환하고 사이트 내비게이션에도 가격, 클라우드 또는 엔터프라이즈 링크가 없습니다. 운영자가 지불하는 비용은 이를 실행할 장소, 전송하는 모델 API 토큰, 그리고 웹 검색·OCR·코드 샌드박스·파일 채팅 임베딩과 같은 선택적 부가 서비스이며, 각각 자체 공급업체가 별도로 청구합니다. LibreChat을 요금제 등급이나 견적 양식과 함께 소개하는 디렉터리 사이트는 존재하지 않는 제품을 설명하는 것입니다.

유료 LibreChat 요금제나 호스팅 버전이 있나요?

프로젝트 자체에서는 제공하지 않습니다. 프로젝트 자체 사이트에서 유료로 제공되는 유일한 제품은 code.librechat.ai의 Code Interpreter API이며, 현재 해당 상점에는 구독을 이용할 수 없고 신규 구독을 받지 않는다는 공지가 표시됩니다. 2025년 인수 게시물은 현재 형태의 중단을 발표했으며 목표일을 2026년 5월 1일로 제시했습니다. 대체 제품은 직접 호스팅하고 LibreChat이 연결하도록 설정하는 Apache-2.0 샌드박스 서비스입니다. 제3자는 관리형 LibreChat을 판매하기도 합니다. Cloud Infrastructure Services의 AWS Marketplace 이미지는 AWS 인프라 비용에 시간당 $0.05의 소프트웨어 요금을 더합니다. 그러나 이는 해당 공급업체의 호스팅 요금이지 LibreChat의 가격이 아닙니다.

LibreChat에 가장 적합한 API는 무엇인가요?

인스턴스를 사용하는 사람 수와 모델을 전환하는지에 따라 다릅니다. 모두 한 공급업체의 모델을 사용하고 해당 공급업체의 자체 캐싱 및 배치 할인을 원한다면 직접 공급업체 API가 유리합니다. 모델 선택기에서 여러 공급업체를 하나의 키와 하나의 잔액으로 관리하려면 단일 사용자 지정 엔드포인트 뒤의 게이트웨이가 유리합니다. apiKey에 리터럴 user_provided를 입력하여 설정하는 사용자별 BYOK는 각 사용자가 자신의 사용량을 부담해야 할 때 유리합니다. Ollama를 통한 로컬 모델은 요청별 요금 없이 비공개 또는 중요도가 낮은 작업에 적합합니다. LibreChat의 공식 권장 사항은 없습니다. 호환성 매트릭스가 사용자 지정 엔드포인트에 요구하는 것은 공급업체가 아니라 구조에 관한 것입니다. 도구, 함수 호출 및 비전은 모델에 따라 달라지는 것으로 표시되고, 이미지 생성과 MCP는 Agents 엔드포인트를 통해서만 사용할 수 있습니다.

LibreChat에 가장 저렴한 API는 무엇인가요?

호스팅된 API 중 가장 저렴하게 표시된 옵션은 Google의 Gemini Developer API 무료 등급입니다. Gemini 3.8 Flash에서 입력·출력·컨텍스트 캐싱에 요금이 부과되지 않으며, 무료 등급의 데이터는 Google 제품 개선에 사용된다는 조건이 있습니다. 유료 등급에서는 그렇지 않다고 명시합니다. 로컬 모델은 요청별 요금이 전혀 없지만 실행하는 하드웨어 비용이 듭니다. 그 외에는 토큰당 최저가와 작업 완료 비용 최저가는 서로 다른 문제입니다. 요약에 세 번 시도해야 하는 소형 모델은 한 번만 시도하면 되는 모델보다 더 비쌀 수 있습니다. 요금표만이 아니라 실제 대화 기록의 양을 기준으로 예산을 세우고, 웹 검색·OCR·파일 채팅 임베딩은 모델 엔드포인트와 완전히 별도로 청구된다는 점을 기억하세요.

LibreChat이 내 모델의 비용을 잘못 표시하는 이유는 무엇인가요?

LibreChat은 공급업체가 실제로 청구한 금액이 아니라 함께 제공되는 표를 기준으로 요청 가격을 책정하기 때문입니다. 매처는 해당 표에서 모델 ID에 포함되는 가장 긴 항목을 사용하므로 gpt-5-6-terra와 같은 게이트웨이 ID는 gpt-5 항목과 일치하고 그 항목의 요금으로 차감됩니다. 전혀 일치하는 항목이 없으면 main의 소스는 토큰당 6크레딧이라는 고정 요금으로 대체하며, 양방향 모두 100만 토큰당 $6입니다. 해결 방법은 사용자 지정 엔드포인트 아래에 모델별 prompt, completion 및 context를 USD/100만 토큰으로 선언하는 tokenConfig 블록을 추가하는 것입니다. 소스는 자체 표를 조회하기 전에 이 재정의를 확인합니다.

LibreChat에 가장 적합한 모델은 무엇인가요?

리더보드가 아니라 엔드포인트가 도달해야 하는 대상에 따라 선택하세요. LibreChat의 자체 호환성 매트릭스는 사용자 지정 OpenAI 호환 엔드포인트에서 도구·함수 호출·비전이 모델에 따라 달라지는 것으로 표시하고, 이미지 생성과 MCP는 일반 채팅 대화가 아니라 Agents 엔드포인트를 통해 라우팅합니다. 따라서 Agents 또는 MCP 도구를 실행하는 인스턴스에는 실제로 도구를 호출하는 모델이 필요하고, 사용자가 스크린샷을 붙여 넣는 인스턴스에는 비전 모델이 필요합니다. titleModel은 별도의 저렴한 모델로 고정하세요. 대화 제목은 자체 요청으로 생성되므로 제목에 최고급 모델 요금을 지불할 이유가 없습니다.

LibreChat에 사용자별 사용량 한도나 예산이 있나요?

있지만 기본적으로 꺼져 있습니다. balance.enabled를 true로 설정하면 토큰 크레딧 추적이 활성화됩니다. 문서화된 기본값에 따르면 신규 사용자의 startBalance는 20,000크레딧이며, LibreChat은 1,000,000크레딧을 미화 1달러로 정의하므로 시작 잔액은 2센트입니다. 자동 충전은 별도의 스위치이며 기본값은 꺼짐이고, 간격은 30일, 충전량은 10,000크레딧입니다. 잔액을 활성화하면 transactions 설정과 관계없이 거래 기록도 강제로 활성화되며, interface.contextCost를 켤 때까지 비용 수치는 사용자에게 숨겨집니다.

2026년 9월 19일에 확인하고 2026년 9월 21일에 다시 확인했습니다. LibreChat GitHub API와 두 LibreChat-AI 위성 저장소, librechat.ai/pricing의 404, Code Interpreter 스토어 공지, ClickHouse 인수 게시물, 사용자 지정 엔드포인트·토큰 사용량·잔액·호환성 문서 페이지, 그리고 저장소의 main, v0.8.6 및 v0.8.7 각각에 있는 가격표와 구성 스키마를 확인했습니다. Anthropic, OpenAI 및 Google의 정가는 해당 날짜에 각자의 가격 페이지에서 확인했습니다. Kunavo 토큰 요금은 실시간 카탈로그에서 가져왔습니다. ChatGPT 구독 가격과 과거 Code Interpreter API 가격은 확인할 수 없어 명시하지 않습니다. 여기의 모든 달러 예시는 실제 측정된 청구액이 아니라 설명을 위한 토큰 비용 계산입니다.