AIREITER

Grok 4.7 API 가격과 코딩 성능 리뷰

마지막 업데이트: 2026-09-21 20:04:44

Grok 4.7을 API 워크플로에 도입하려 한다면, 흔히 보이는 요금 정보만으로는 부족합니다. xAI 공식 문서에 따르면 표준 API 요금은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6입니다. 공식 모델 ID는 grok-4.7이지만, 실제 청구액은 게이트웨이 이용 여부, 미국 리전 라우팅, 캐시 적중, 긴 컨텍스트 사용량에 따라 달라질 수 있습니다.

결론부터 말하면: API 접근은 가능하지만 $2/$6은 직접 호출 기준선일 뿐이다

Grok 4.7은 소문이나 채팅 전용 이름에 그치지 않습니다. 2026년 9월 21일 업데이트된 xAI 공식 페이지는 Responses API와 Chat Completions를 통한 API 사용을 안내하고 있습니다. 500,000토큰 컨텍스트 윈도우, 텍스트 및 이미지 입력, 텍스트 출력, 함수 호출, 웹 검색, X 검색, 코드 실행도 지원 항목으로 명시돼 있습니다.

$2/$6 요금은 정확히 말해 표준 직접 호출 요금으로 확인됩니다.

호출 경로 또는 사용 방식입력출력의미
xAI 직접 API, 표준$2.00/M$6.00/Mgrok-4.7의 공식 기준 요금
xAI 미국 리전 엔드포인트$2.20/M*$6.60/M*표준 요금보다 10% 높은 요금
OpenRouter 표준 등록 요금$1.60/M$4.80/MxAI 직접 요금이 아닌 게이트웨이·프로바이더 요금
Vercel AI Gateway 프로모션$1.20/M$3.60/M2026년 9월 27일까지 표시된 프로모션 요금

*미국 리전 요금은 별도로 고지된 대표 가격이 아니라, xAI가 문서화한 10% 프리미엄을 기준으로 계산한 값입니다. xAI 직접 사용 예산은 $2/$6을 기준으로 잡고, 게이트웨이 요금은 호출 경로별로 조건과 제공 여부를 확인해야 합니다.

xAI 공식 API에서 제공하는 기능

공식 모델 식별자는 grok-4.7입니다. xAI는 세 가지 호출 방식을 안내합니다. 자체 SDK를 사용하거나, https://api.x.ai/v1을 가리키는 OpenAI 호환 클라이언트를 이용하거나, https://api.x.ai/v1/responses로 직접 POST 요청을 보낼 수 있습니다.

에이전트 작업과 관련해 문서에 명시된 사양은 다음과 같습니다.

항목xAI 문서 기준 값
컨텍스트 윈도우500,000토큰
지식 기준일2026년 5월
추론 수준Low, medium, high, xhigh
기본 추론 수준High
입력텍스트 및 이미지
출력텍스트
APIResponses API 및 Chat Completions
도구함수 호출, 웹 검색, X 검색, 코드 실행
표준 입력 요금토큰 100만 개당 $2
표준 출력 요금토큰 100만 개당 $6

공식 문서의 예제는 JavaScript로 작성한 중앙값 함수에서 버그를 찾아 설명하도록 모델에 요청합니다. 다만 이는 API 연결 방식의 예일 뿐, 코딩 품질을 검증한 결과는 아닙니다. 해당 페이지에는 독립적인 벤치마크 표, 지연 시간 측정치, 가동 시간 보장, 작업 완료율이 포함돼 있지 않습니다.

Grok 4.7 API 요금에서 실제 청구액을 바꾸는 변수

직접 API와 게이트웨이 요금은 구분해야 한다

OpenRouter 모델 페이지에는 입력 $1.60/M, 출력 $4.80/M, 캐시 읽기 $0.40/M가 표시돼 있습니다. Vercel AI Gateway 페이지는 40% 할인 프로모션을 적용한 입력 $1.20/M, 출력 $3.60/M를 안내하며, 프로모션 종료일은 2026년 9월 27일입니다.

게이트웨이 요금에는 프로모션이나 별도 라우팅 조건이 반영될 수 있습니다. 따라서 토큰 단가만 보지 말고 요청 전체에 드는 비용을 비교해야 합니다.

미국 리전 라우팅에는 10% 프리미엄이 붙는다

xAI는 https://us.api.x.ai/v1을 미국 리전 엔드포인트로 제공하며, 토큰 사용량에 10% 프리미엄을 적용한다고 설명합니다. 표준 요금을 기준으로 계산하면 입력은 $2.20/M, 출력은 $6.60/M입니다.

저장소 프롬프트를 반복해서 보낸다면 캐시가 중요하다

xAI는 캐시 라우팅 식별자로 Responses API에서는 prompt_cache_key, Chat Completions에서는 x-grok-conv-id 헤더를 사용할 것을 권장합니다. 같은 서버로 반복 요청을 보내면 캐시 적중 가능성이 높아지지만, 캐시가 비어 있는 요청에서는 입력 토큰에 대한 전체 요금을 부담할 수 있습니다.

Cursor의 Grok 4.7 요금표에는 호스팅 환경의 참고값으로 표준 등급 캐시 읽기 $0.50/M, 캐시되지 않은 입력 $2/M가 제시돼 있습니다. 이는 Cursor의 과금 기준이며, xAI 직접 API가 동일한 캐시 요금을 적용한다는 의미는 아닙니다.

긴 컨텍스트를 쓴다고 무료가 되는 것은 아니다

Cursor는 표준 컨텍스트를 256k, 최대 컨텍스트를 500k로 안내합니다. 문서에 따르면 256k를 초과하는 요청에는 더 높은 긴 컨텍스트 요금이 적용되며, 표준 사용은 2배, Fast 사용은 3배입니다.

xAI는 500k 컨텍스트를 지원한다고 확인했지만, 모델 요약 페이지에서 긴 컨텍스트에 적용되는 별도 배수를 공개하지는 않았습니다. 500k 컨텍스트도 기본 요금으로 처리된다고 가정하기 전에 실제 호출 경로의 과금 규칙을 확인해야 합니다.

공개된 코딩 근거가 말해주는 것과 말해주지 않는 것

Grok 4.7이 공식적으로 내세우는 핵심 사용처는 장시간 실행되는 에이전트 작업입니다. xAI, Cursor, OpenRouter는 코딩, 장기 소프트웨어 엔지니어링, 자체 검증, 긴 컨텍스트 처리에 초점을 맞춰 제품을 설명합니다. Cursor 모델 문서에는 에이전트 환경에서 파일 검색, 파일 편집, 셸 명령, 브라우저 제어, 웹 접근, 이미지 생성, 추가 질문 기능을 사용할 수 있다고 나와 있습니다.

이 정도 기능이면 코딩 파일럿을 진행할 근거는 충분합니다. 하지만 버그 수정, 테스트 통과율, 작업 단위당 비용이 더 뛰어나다는 뜻은 아닙니다. 재현 가능한 저장소 테스트를 구성하고 작업 성공 여부, 재시도 횟수, 도구 호출 수, 실제 소요 시간, 총 토큰 사용량을 기록해야 합니다.

추론 설정은 low부터 xhigh까지 제공되며 기본값은 high입니다. 높은 설정을 사용하면 처리 시간이 길어지고 사용량도 달라질 수 있으므로, 운영 비용을 예측하기 전에 사용 중인 프로바이더가 추론 사용량을 어떻게 보고하고 과금하는지 확인해야 합니다.

최신 정보가 필요한 작업에는 검색과 검색 증강이 필요하다

Grok 4.7은 이미지를 입력으로 받을 수 있고 웹 검색과 X 검색을 지원하며, 지식 기준일은 2026년 5월입니다. 최신 정보를 다루는 업무라면 검색이나 검색 증강을 활용하고, 문장 자체만 평가하지 말고 인용 정확도, 출처 범위, 수정 횟수, 사람이 바로잡는 데 걸린 시간을 함께 측정해야 합니다.

두 가지 에이전트 루프의 예상 비용

직접 호출 기준의 표준 요금은 다음과 같이 계산할 수 있습니다.

cost = (input_tokens / 1,000,000 × $2) + (output_tokens / 1,000,000 × $6)

예시 요청입력 비용출력 비용토큰 비용
입력 100k + 출력 20k$0.20$0.12$0.32
입력 500k + 출력 50k$1.00$0.30$1.30

두 번째 예시는 기본 요금만 적용한 계산입니다. 미국 리전 프리미엄, 호스팅 경로의 긴 컨텍스트 배수, 캐시되지 않은 반복 프롬프트, 프로바이더별 추론 과금 규칙, 추가 요청이 붙으면 비용은 더 커질 수 있습니다. 코딩 에이전트가 요청을 10번 보내는 경우, 500k토큰 요청을 한 번 보내는 것보다 훨씬 비싸질 수 있습니다.

도입을 결정하기 전에 API 접근을 검증하는 방법

  1. 공식 모델 ID를 사용하세요. 추측으로 만든 별칭이나 게이트웨이 전용 이름이 아니라 grok-4.7을 보내야 합니다.
  2. 작은 Responses API 요청부터 시작하세요. xAI 문서는 Bearer 인증과 텍스트 입력을 포함한 POST https://api.x.ai/v1/responses 요청을 안내합니다.
  3. 응답과 청구서에서 사용량을 기록하세요. 입력 토큰, 출력 토큰, 제공되는 경우 추론 사용량, 도구 호출 수, 실제 청구액을 저장해야 합니다.
  4. 캐시는 별도로 테스트하세요. 긴 시스템 프롬프트를 prompt_cache_key와 함께 반복 전송하고 두 번째 요청의 입력 과금이 어떻게 달라지는지 비교합니다.
  5. 사용할 컨텍스트 등급을 확인하세요. 애플리케이션에 긴 저장소 컨텍스트가 필요하다면 256k 이하에서 한 번, 그 이상에서 한 번 실행해 비교합니다.
  6. 엔드포인트를 의도적으로 선택하세요. 기준 비용을 확인할 때는 표준 엔드포인트를 사용하고, 미국 리전의 데이터 위치 이점이 10% 프리미엄을 정당화할 때만 미국 리전 엔드포인트를 선택합니다.
  7. 게이트웨이 요금은 별도 상품으로 취급하세요. 예산에 $1.20/$3.60 또는 $1.60/$4.80을 반영하기 전에 프로모션 종료일, 프로바이더 라우팅, 장애 시 대체 동작, 데이터 보존 조건, 경로별 추가 요금을 확인해야 합니다.
  8. 완료된 작업을 기준으로 측정하세요. 코딩 작업이라면 테스트 통과 수, 재시도, 도구 호출 수, 실제 소요 시간, 승인된 변경 1건당 총비용을 기록합니다.

Grok 4.7 API FAQ

Grok 4.7은 공식 API에서 사용할 수 있나요?

네. xAI 문서에는 Responses API와 Chat Completions에서 사용할 수 있는 grok-4.7 모델이 등록돼 있으며, SDK, OpenAI 호환 방식, cURL 예제도 제공됩니다.

입력 $2, 출력 $6이 확인된 요금인가요?

네. 2026년 9월 21일 문서에 기재된 xAI 표준 직접 API 요금 기준입니다. 미국 리전 엔드포인트를 사용하면 10%가 추가되고, 게이트웨이는 다른 요금이나 프로모션을 표시할 수 있습니다.

Grok 4.7은 코딩에 적합한가요?

도구 사용, 조절 가능한 추론 수준, 컨텍스트 압축 관련 안내, 최대 500k 컨텍스트를 제공하므로 장시간 실행되는 코딩 에이전트의 파일럿 후보로는 충분히 고려할 만합니다. 다만 공개된 자료만으로 코딩 성능의 우위를 독립적으로 입증할 수는 없으므로, 실제 저장소 작업으로 검증해야 합니다.

Grok 4.7의 컨텍스트 윈도우는 500k인가요?

네. xAI는 500,000토큰으로 안내합니다. 한편 Cursor는 표준 컨텍스트를 256k, 최대 등급을 500k로 별도 설명하며 256k를 초과하면 더 높은 요금이 적용된다고 밝히고 있습니다.

Grok 4.7 Fast를 공개 API에서 사용할 수 있나요?

아니요. xAI의 Grok 4.7 문서는 Grok 4.7 Fast를 더 빠른 인프라에서 실행하는 동일 모델로 설명하며, 표준 요금의 2배가 적용된다고 안내합니다. 하지만 공개 xAI API에서는 사용할 수 없다고 명시합니다. 현재 Cursor와 Grok Build에 등록돼 있습니다.

최종 판단: 파일럿은 진행하되 실제 사용할 경로 기준으로 예산을 잡아라

Grok 4.7의 API 접근성과 $2/$6 기준 요금은 확인됐지만, 코딩 성능의 우위까지 입증된 것은 아닙니다. 256k가 넘는 토큰을 보내거나, 캐시되지 않은 저장소 컨텍스트에 의존하거나, 미국 리전을 사용하거나, 추론 호출을 여러 번 발생시키는 워크로드라면 완료된 작업 1건당 비용은 크게 달라질 수 있습니다. 운영 환경을 이전하기 전에 실제 작업을 기준으로 측정하는 파일럿부터 시작하는 것이 좋습니다.