AIREITER

Mistral Large 4 API 가격: 프리뷰에서 실제로 쓸 수 있는 것들

마지막 업데이트: 2026-10-06 18:54:47

100만 토큰 컨텍스트와 입력 토큰 100만 개당 0.68달러라는 가격만 보면, Mistral Large 4는 1조 개가 넘는 파라미터를 가진 모델치고 이례적으로 저렴해 보입니다. 하지만 아직은 공개 프리뷰 단계입니다. 할인 가격의 종료 시점은 명확하지 않고, 게이트웨이별 한도는 모델 사양에 적힌 수치와 다를 수 있으며, 향후 공개될 가중치의 라이선스도 아직 발표되지 않았습니다.

1분 만에 내리는 결론

문서, 코드 저장소, 도구 호출 워크플로를 API로 처리하면서 비용을 낮추고 긴 컨텍스트를 활용하고 싶다면 Mistral Large 4를 지금 테스트해볼 만합니다. 다만 이 프리뷰를 안정적인 자체 호스팅 대안으로 보거나, 코딩 벤치마크에서 이미 검증된 최상위 모델로 평가하기에는 아직 이릅니다.

필요한 것판단
API로 긴 문서나 대규모 코드베이스를 테스트하고 싶다지금 테스트하되 캐시 적중률과 출력 비용을 함께 측정
장기적으로 예측 가능한 가격이 필요하다기다리거나 더 높은 요금을 기준으로 예산 책정: 입력 1.36달러, 출력 4.18달러
프라이빗 배포가 필요하다가중치, 라이선스, 양자화 방식, 서빙 가이드가 나올 때까지 대기
가장 높은 코딩 점수가 필요하다출시 수치만 보고 선택하지 말 것. 실제 작업에 같은 평가 하니스를 적용

이것은 최종 모델 평가가 아니라 공개 프리뷰 API를 도입할지에 대한 판단입니다. Mistral은 2026년 10월 6일 프리뷰를 발표했으며, 공개 자료에서는 가중치를 10월 말에 공개할 예정이라고 밝혔습니다. (Mistral 발표문)

10월 6일 현재 실제로 사용할 수 있는 것

Mistral Large 4는 Mistral Studio를 통해 공개 프리뷰 API로 사용할 수 있습니다. Mistral은 이 모델을 네이티브 멀티모달 기능을 지원하는 혼합 전문가 모델로 설명하며, 전체 파라미터는 1조 500억 개, 토큰당 활성 파라미터는 490억 개라고 밝히고 있습니다. 공식 발표에는 함수 호출, 구조화된 출력, 문서 질의응답, 배치 처리, 에이전트, 내장 도구 지원도 포함돼 있습니다.

또한 OpenRouter에는 mistralai/mistral-large-4-0으로 등록돼 있습니다. 따라서 OpenRouter 액세스는 더 이상 출시 당일에만 돌던 소문이 아닙니다. 다만 경로에 따라 한도, 지연 시간, 과금 방식, 폴백 정책은 달라질 수 있습니다.

API는 현재 작동하지만 다운로드 가능한 가중치와 최종 라이선스는 아직 공개되지 않았습니다. Mistral이 모델 카드와 이용 약관을 발표하기 전까지는 ‘오픈 웨이트’를 제한 없는 상업용 오픈소스로 받아들여서는 안 됩니다.

가격이 두 가지로 표시되는 이유

현재 Mistral 모델 문서에 표시된 프리뷰 요금은 상당히 매력적입니다.

토큰 유형프리뷰 요금출시 자료에 표시된 프리뷰 이후 가능 요금
입력토큰 100만 개당 0.68달러토큰 100만 개당 1.36달러
캐시된 입력토큰 100만 개당 0.07달러토큰 100만 개당 0.14달러
출력토큰 100만 개당 2.09달러토큰 100만 개당 4.18달러

낮은 요금은 Vercel 게이트웨이 등록 페이지와 다른 모델 액세스 페이지에서 프리뷰 기간 50% 할인 가격으로 안내되고 있습니다. 그러나 종료 시점은 명시돼 있지 않습니다. 따라서 0.68달러와 2.09달러를 영구 요금이 아니라 현재 적용되는 가격으로 봐야 합니다.

캐시되지 않은 입력 토큰 50만 개와 출력 토큰 10만 개를 처리하는 작업이라면 프리뷰 기준 비용은 약 0.55달러입니다. 입력 비용 0.34달러와 출력 비용 0.209달러를 합친 금액입니다. 입력이 캐시된 경우에는 약 0.244달러로 내려갑니다. 캐시된 입력 비용 0.035달러와 출력 비용 0.209달러를 더한 값입니다. 실제 트래픽을 옮기기 전에는 캐시 재사용률, 출력량, 할인 가격이 얼마나 유지될지를 함께 평가해야 합니다.

컨텍스트와 기능은 사용하는 경로에 따라 달라진다

Mistral의 모델 문서에는 컨텍스트 윈도우가 100만 토큰으로 기재돼 있습니다. 다만 이는 모델 수준의 사양일 뿐, 모든 게이트웨이가 동일한 한도를 제공한다는 뜻은 아닙니다.

Vercel AI Gateway 페이지에는 현재 Mistral 프로바이더 기준 공유 컨텍스트 윈도우가 524K, 최대 출력이 262K로 표시돼 있습니다. 게이트웨이 트래픽을 기준으로 첫 토큰까지 걸리는 시간의 P50은 0.9초, 초당 처리량은 38토큰, 캐시 적중률은 74%로 보고됩니다.

Mistral Large 4 gateway pricing and provider metrics

이 수치는 모델 전체에 적용되는 보장이 아니라 특정 경로의 수치입니다. 해당 페이지는 이미지 입력, 도구 호출, OpenAI 호환 Chat Completions 및 Responses API, Anthropic 호환 Messages 액세스를 지원한다고 설명합니다. 게이트웨이 ID도 OpenRouter의 프로바이더 지정 ID와 다른 mistral/mistral-large-4입니다.

실제 연동에 앞서 사용하는 엔드포인트의 공유 컨텍스트 한도, 출력 상한, 이미지 및 토큰 계산 방식, 도구 동작, 캐시 정책, 프로바이더 라우팅, 폴백 규칙을 확인해야 합니다. 100만 토큰이라는 대표 수치는 후보를 좁힐 때 유용하지만, 애플리케이션 규모를 산정하기에는 충분하지 않습니다.

벤치마크 결과로 어디까지 판단할 수 있나

TechsCurrent의 출시 분석은 Mistral이 공개한 수치로 DeepSWE v1.1 61.7%, Terminal-Bench 4 28.3%, AutomationBench 59.9%를 제시합니다. CellCog의 출시 비교는 DeepSWE에서 DeepSeek V4.1 Flash가 74.2, Mistral Large 4가 61.7이라고 인용했으며, AutomationBench에서는 Mistral의 수치가 비교 대상 행보다 높다고 설명합니다. 다만 이는 한 곳에서 동일한 기준으로 측정한 순위표가 아니라, 업체가 공개한 수치와 서로 다른 출처의 결과를 조합한 신호입니다.

모델을 실제 운영 에이전트에 투입하기 전에는 다음과 같은 고정 평가를 진행하는 편이 좋습니다.

  1. Mistral Large 4와 기존 모델에 동일한 저장소, 프롬프트, 도구, 타임아웃을 적용합니다.
  2. 작업 완료율, 도구 인자 오류, 재시도 횟수, 지연 시간, 출력 토큰 수, 비용을 측정합니다.
  3. 입력 중간과 끝부분에 정답이 등장하는 긴 컨텍스트 검색 사례를 추가합니다.
  4. 캐시된 컨텍스트와 캐시되지 않은 컨텍스트로 테스트를 반복합니다.
  5. 프리뷰 결과와 향후 가중치 공개 이후의 결과를 별도로 관리합니다.

지금 사용해볼 만한 팀

반복적으로 큰 컨텍스트를 보내는 API 중심 팀: Mistral Large 4를 지금 테스트해볼 만합니다. 에이전트가 동일한 정책 문서, 저장소, 문서 앞부분을 반복해서 전송한다면 입력 캐시 요금이 토큰 100만 개당 0.07달러라는 점이 유리할 수 있습니다. 다만 더 높은 요금이 적용될 가능성을 고려해 실험 예산에는 상한을 설정해야 합니다.

이미지를 이해하는 문서 워크플로를 구축하는 팀: 실제 배포할 경로에서 이미지 입력과 문서 추출을 테스트하세요. 모델은 이미지 입력을 지원하지만, 경로별 파일 한도와 과금 방식은 아직 직접 확인해야 합니다.

코딩 에이전트를 개발하는 팀: 자동 우승 후보가 아니라 비교 대상 모델로 활용하세요. 공개된 벤치마크 결과는 엇갈리며, 실제 신뢰성은 도구 호출, 재시도, 작업 완료율에 따라 달라집니다.

개인정보 보호나 자체 호스팅이 중요한 팀: 가중치와 라이선스가 공개될 때까지 기다리는 편이 좋습니다. 활성 파라미터가 490억 개라는 수치가 전체 체크포인트가 작다는 뜻은 아닙니다. 전체 모델을 저장하고 서빙해야 하기 때문입니다. 필요한 하드웨어, 양자화 방식, 처리량, 재배포 권리는 아직 확인되지 않았습니다.

Mistral Large 4 API FAQ

Mistral Large 4는 이미 오픈소스인가요?

출시 시점에는 최종 라이선스나 다운로드 가능한 가중치가 공개되지 않았습니다. Mistral은 2026년 10월 말까지 가중치를 공개할 계획이지만, ‘오픈 웨이트’라는 표현만으로 상업적 이용이나 재배포 권리가 정해지는 것은 아닙니다.

0.68달러 요금이 영구적으로 유지되나요?

종료 시점은 명시돼 있지 않습니다. 테스트 예산은 현재 요금인 입력 0.68달러와 출력 2.09달러를 기준으로 잡되, 입력 1.36달러와 출력 4.18달러가 적용되는 경우도 함께 계산해야 합니다.

컨텍스트 윈도우는 100만 토큰인가요, 524K인가요?

Mistral은 모델 컨텍스트를 100만 토큰으로 설명하고 있으며, Vercel은 자사 게이트웨이 경로의 공유 컨텍스트를 524K로 표시합니다. 실제로 호출할 프로바이더와 API 형식에 맞는 한도를 확인해야 합니다.

이미 OpenRouter에서 사용할 수 있나요?

네. OpenRouter에는 현재 mistralai/mistral-large-4-0이 등록돼 있습니다. 프리뷰 라우팅은 바뀔 수 있으므로 배포 전에 실시간 페이지를 다시 확인하세요.

이미지와 도구를 처리할 수 있나요?

공식 문서와 게이트웨이 문서 모두 이미지 입력과 도구 호출을 지원한다고 설명합니다. 사용할 경로에서 요청 형식, 이미지 한도, 토큰 계산 방식, 잘못된 도구 호출에 대한 동작을 직접 테스트해야 합니다.

가중치가 공개되면 자체 호스팅해야 하나요?

자동으로 그렇게 결정할 필요는 없습니다. 라이선스, 체크포인트 형식, 양자화 옵션, 메모리 요구 사항, 처리량 데이터, 기준 서빙 구성이 공개될 때까지 기다리는 편이 좋습니다.

다음으로 진행할 테스트

실제 트래픽을 보내기 전에 20개 작업으로 평가 세트를 만들어보세요. 긴 컨텍스트 검색 5개, 코딩 변경 5개, 이미지 및 문서 질문 5개, 도구 호출 작업 5개로 구성하면 됩니다. 성공률, 재시도 횟수, 첫 토큰까지 걸리는 시간, 전체 지연 시간, 입력·캐시·출력 토큰 수, 작업 하나를 완료하는 데 드는 실질 비용을 기록하세요.

출처: Mistral 모델 문서, Mistral 발표문, Vercel AI Gateway, OpenRouter 모델 페이지, TechsCurrent, CellCog.