Elon Musk는 2025년 8월 7일 X에 Grok 5가 “올해가 끝나기 전에 나올 것이며, 압도적으로 좋을 것”이라고 썼다. 하지만 2025년 말은 지나갔고, 2026년 1분기와 2분기도 마찬가지였다. 지금까지 xAI가 공식적으로 확인한 내용은 생각보다 제한적이다. Grok 5가 존재하고, Colossus 2 슈퍼클러스터에서 학습 중이라는 사실이 전부에 가깝다. 예측시장은 현재 2026년 12월 31일까지 출시될 가능성을 82%로 반영하고 있지만, 앞선 목표 시점들도 마감되기 전까지는 충분히 그럴듯해 보였다.
지나간 Grok 5 출시 목표들
Grok 5의 출시 시점을 가늠할 때 가장 유용한 자료는 Musk의 약속과 실제 출시 사이의 간극이다. 지금까지의 흐름을 정리하면 다음과 같다.
| 목표 시점 | 출처 | 결과 |
|---|---|---|
| “2025년 말 이전” | 2025년 8월 7일, Musk의 X 게시물 | 불발 - 2025년 내 출시 없음 |
| 2026년 1분기 | 투자 유치 과정에서 논의됐다고 보도됨 | 불발 - 1분기는 3월 31일 종료 |
| 2026년 2분기 / 6월 30일 이전 | 2026년 2월 25일, Grok의 X 계정 | 불발 - Polymarket 계약은 0.8%로 만료 |
| 2026년 3분기 또는 그 이후 | 현재 애널리스트 컨센서스 | 미정 |
출시 목표가 빗나갈 때마다 xAI가 침묵했던 것은 아니다. 2026년 4월 30일에는 100만 토큰 컨텍스트 윈도우를 갖춘 Grok 4.3이 나왔다. 이어 2026년 7월 8~9일, 약 1.5T 파라미터 규모의 Grok 4.5가 출시됐다. xAI 내부 명칭은 “V9-Medium”이며, Cursor 개발자 데이터가 일부 학습에 쓰였다는 보도도 나왔다. 이후 Grok 4.6도 뒤따랐다. 제품군은 계속 업데이트됐지만, 이 모델들은 모두 Grok 5가 아니다.
지금까지의 사례를 보면 xAI의 일정 언급은 확정된 약속보다는 낙관적인 목표치로 받아들이는 편이 맞다.
확인된 내용과 루머를 구분하면
커뮤니티 계정과 xAI의 메시지는 종종 사실과 추측의 경계를 흐린다. 그래서 검증된 정보와 루머를 나눠 볼 필요가 있다.
| 주장 | 상태 | 근거 |
|---|---|---|
| Grok 5가 존재하며 학습 중 | 확인됨 | 2026년 1월 6일 xAI의 $20B Series E 발표($230B 기업가치; NVIDIA, Cisco, Fidelity 등이 투자자) |
| 테네시주 멤피스의 Colossus 2에서 학습 | 확인됨 | 동일 발표; 클러스터는 2026년 1월 가동 |
| 6조 파라미터(MoE) | 미확인 | @grok 계정을 통한 커뮤니티 보도; 모델 카드 없음 |
| 10조 파라미터 변형 모델 | 미확인 | 커뮤니티 출처로 거론된 2차 루머 |
| 약 150만 토큰 컨텍스트 윈도우 | 미확인 | Grok 4의 2M, Grok 4.5의 500K를 근거로 한 추정 |
| 16개 이상 병렬 에이전트로 확장 | 미확인 | Grok 4.20은 4개 에이전트로 작동했으며, 16개 확장은 추론에 불과함 |
| “Reality Engine” 실시간 팩트체커 | 미확인 | 공식 제품명 없음; 루머에 그침 |
| 학습에 Cursor 개발자 데이터 사용 | 미확인 | Grok 4.5가 이미 Cursor 데이터를 사용했다는 점에서 가능성은 있지만 Grok 5에 대해서는 확인되지 않음 |
| Musk가 언급한 “10%이며 계속 오르는” AGI 확률 | Musk의 주장 | 2025년 10월 발언; 운용 가능한 AGI 정의는 제시되지 않음 |
마지막 항목은 특히 짚어볼 필요가 있다. Musk는 Grok 5가 AGI에 도달할 확률이 10%이고 계속 높아지고 있다고 봤지만, 벤치마크나 검증 가능한 기준, 업계 동의는 제시하지 않았다. GEO Toolbox는 이를 “발견이 아니라 포지셔닝”이라고 평가했다. 기술적 판단보다는 마케팅 신호로 보는 편이 적절하다.
Colossus 2만큼은 이견이 없다
Grok 5가 단순한 루머가 아니라 상당한 규모의 실체를 가진 프로젝트라는 가장 강력한 근거는 Colossus 2다.
확인된 사양: Colossus 2는 테네시주 멤피스에 구축된 기가와트급 학습 클러스터로, 2026년 1월부터 가동 중이다. Fello AI 보도에 따르면 이 클러스터에는 과거 보도에서 언급된 H100이 아니라 NVIDIA GB200 및 GB300 GPU가 약 550,000개 사용된다. 2026년 7월 기준으로는 1T, 1.5T, 6T, 10T 파라미터급 모델을 포함해 7개의 대형 학습 작업이 동시에 진행 중이었다고 전해진다. SpaceX는 2026년 2월 2일 xAI를 인수하면서 이 컴퓨팅 자원을 더 큰 기업 구조 안으로 편입했다.
이 규모가 시사하는 점: 이 정도의 클러스터는 소폭 업데이트를 위해 구축하는 인프라가 아니다. 6T와 10T 파라미터급 학습 작업은 xAI가 단순한 마이너 버전업이 아니라 세대 교체급 도약을 노리고 있다는 가장 강한 비공식 신호다. 이 투자가 경제적으로 성립하려면 Grok 5는 Grok 4.5보다 눈에 띄게 뛰어난 성능을 내야 한다.
효율성이라는 반론: 다만 규모가 곧 품질을 보장하지는 않는다. ZBuild의 보도에 따르면 DeepSeek V4는 훨씬 적은 학습 비용으로 MoE-plus-Engram 아키텍처를 활용해 SWE-Bench Verified에서 81%를 기록했다. Grok 5는 무차별적 스케일링이 여전히 통한다는 사례가 될 수도, 그렇지 않다는 사례가 될 수도 있다.
예측시장이 보는 실제 출시 확률
xAI가 제시해 온 일정보다 꾸준히 보수적이었던 트레이더들의 실제 자금이 반영된 예측시장은, 과열된 기대를 가늠하는 데 유용한 반대축이다.
| 마감일 | 플랫폼 | 내재 확률 |
|---|---|---|
| 2026년 8월 15일 | Polymarket | 1% |
| 2026년 8월 31일 | Polymarket | 4% |
| 2026년 10월 1일 | Kalshi | 68% |
| 2026년 12월 31일 | Polymarket | 82% |
| 2027년 1월 1일 | Kalshi | 78% |
Polymarket은 2026년 4월 당시 6월 30일까지 출시될 확률을 33%로 반영했다. 이 계약은 결국 0.8%로 만료됐다. 현재 수치가 말해주는 것은 xAI 발표와 조금 다르다. 10월 이전 출시는 가능성이 낮지만, 연말까지의 확률은 계획에 반영할 만한 수준으로 높다.
다만 두 가지는 유의해야 한다. 예측시장마다 “출시” 판정 기준이 다르며, 제한된 프리뷰부터 완전한 API 제공까지 무엇이든 출시로 간주될 수 있다. 또한 이 수치는 실시간 호가가 아니라 특정 시점의 스냅샷이다.
Grok 5가 넘어야 할 경쟁 모델
Grok 5가 출시될 시장은 비어 있지 않다. 벤치마크, 가격, 개발자 경험 전반에서 현재 최상위 모델들이 높은 기준을 만들고 있다.
| 모델 | 컨텍스트 | API 가격(입력/출력, M 토큰당) | 핵심 강점 |
|---|---|---|---|
| GPT-5.6 Sol | 1M | $5 / $30 | Agents' Last Exam 52.7%; 멀티 에이전트 도구 |
| Claude Opus 5 | 1M | $5 / $25 | GDPval-AA v2 최고 점수; 심층 추론 |
| Grok 4.5 | 500K | $2 / $6 | Terminal Bench 83.3%; 최저가 프런티어 API |
| Gemini 3.5 Pro | 2M | 공개되지 않음 | 가장 긴 컨텍스트; 강력한 멀티모달 성능 |
GEO Toolbox는 Grok 5 API 가격을 입력 토큰 100만 개당 약 $5–8, 출력 토큰 100만 개당 $20–30으로 추정한다. 모델 규모가 커지는 만큼 Grok 4.5의 $2/$6보다 큰 폭으로 오르는 셈이다. 소비자용 접근 방식은 기존 xAI 구독 체계를 따를 가능성이 높다. SuperGrok은 월 약 $30, 상위 티어는 월 약 $300, X Premium+는 월 $40 수준이다.
Grok 5가 파라미터 수만 앞세운 모델에 그치지 않으려면 xAI의 현 모델이 약한 영역에서 측정 가능한 개선을 보여야 한다. Claude Opus 5가 앞선 폭넓은 추론 깊이, GPT-5.6 Sol이 우위인 자율 멀티스텝 에이전트의 신뢰성, Gemini 3.5 Pro가 선도하는 컨텍스트 길이가 대표적이다. X 데이터 스트림에 실시간으로 접근할 수 있다는 Grok만의 강점은 시사 추론에서 차별점이 될 수 있지만, 일반 지능 전반의 우위와는 다른 이야기다.
지금 바로 쓸 만한 모델
Grok 5를 기다린다면 그 사이 어떤 모델을 쓸지 정해야 한다. 용도별 선택지는 비교적 명확하다.
- 고난도 코딩과 에이전트 작업: Grok 4.5는 이 용도에서 xAI의 현 플래그십이다. SWE-Bench Pro에서 64.7%(벤더 발표 기준)를 기록했고, 같은 벤치마크에서 Claude Opus 4.8보다 출력 토큰을 4.2배 적게 사용했다. M 토큰당 $2/$6으로 프런티어 API 중 가장 저렴하기도 하다.
- 긴 컨텍스트가 필요한 작업: Gemini 3.5 Pro의 200만 토큰 컨텍스트 윈도우는 Grok 4.5의 500K로는 한 번의 호출에 담을 수 없는 문서를 처리할 수 있다.
- 비용에 민감한 API 작업: Grok 4.3은 1M 컨텍스트에 M 토큰당 $1.25/$2.50으로 여전히 예산형 선택지다. 가장 어려운 코딩 작업에서는 성능이 떨어지지만, 일반적인 추론 작업에는 충분하다.
- 최상위 추론 성능: Claude Opus 5와 GPT-5.6 Sol이 현재 벤치마크 선두다. 직접 비교는 GPT-5.6 Sol vs Grok 4.5 비교 분석에서 확인할 수 있다.
커뮤니티에서 나오는 한 가지 경고도 있다. Grok의 벤치마크 성적이 실제 사용 경험과 항상 일치했던 것은 아니다. r/singularity의 한 Reddit 사용자는 “Grok 4는 벤치마크를 휩쓴다. Grok 5가 실제로 해낼 수 있는지 보자”고 요약했다. 또 다른 사용자는 연구 작업에서 2~3분을 기다릴 수 있을 때는 Grok을 쓰지만, 속도와 코딩에서는 ChatGPT를 선호한다고 말했다. 어디까지나 개인 의견이지만, 높은 벤치마크와 엇갈리는 실사용 평가라는 패턴은 Grok 5 출시 데이터가 나오면 계속 지켜볼 만하다.
핵심 불확실성은 Grok 5가 출시되느냐가 아니다. 기가와트급 클러스터에서 6조 파라미터를 학습한 결과가 더 효율적인 아키텍처를 이기는 모델로 이어질지, 아니면 실전에서는 기대에 못 미치는 또 하나의 벤치마크 선두 모델이 될지에 있다.
FAQ
Grok 5는 이미 출시됐나?
아니다. 2026년 8월 기준 Grok 5는 출시되지 않았다. xAI는 2026년 1월 Series E 발표에서 Colossus 2 슈퍼클러스터에서 학습 중임을 확인했지만, 공개 모델과 API 엔드포인트, 모델 카드는 아직 없다. 2026년 7월 8일 출시된 Grok 4.5가 현재 xAI의 플래그십이다.
Grok 5는 언제 나오나?
공식 출시일은 없다. 예측시장은 2026년 10월 1일까지 출시될 가능성을 Kalshi에서 68%, 2026년 12월 31일까지의 가능성을 Polymarket에서 82%로 반영하고 있다. 2025년 말, 2026년 1분기, 2026년 2분기라는 이전 목표는 모두 지켜지지 않았다.
Grok 5의 파라미터 수는 얼마인가?
커뮤니티에서 가장 널리 거론되는 추정치는 Mixture-of-Experts 아키텍처 기반 6조 파라미터다. 10조 파라미터 변형 모델이라는 루머도 있다. 어느 수치도 xAI가 확인하지는 않았다. 참고로 Grok 4.5는 약 1.5T 파라미터다.
Grok 5는 무료로 제공되나?
가격은 아직 발표되지 않았다. 애널리스트들은 API 비용을 입력 토큰 100만 개당 $5–8, 출력 토큰 100만 개당 $20–30으로 추정한다. 소비자 접근은 X에서의 제한적 무료 사용, SuperGrok($30/month)를 통한 전체 이용, 월 약 $300의 프리미엄 티어라는 기존 체계를 따를 가능성이 높다.
Grok V9-Medium은 Grok 5와 같은 모델인가?
아니다. Grok V9-Medium은 Grok 4.5로 출시된 모델의 내부 명칭이다. Cursor 데이터를 일부 학습에 사용한 1.5T 파라미터 코딩 모델이다. Grok 5는 별개의 더 큰 모델로, 여전히 학습 중이다. 두 모델을 혼동하면서 “Grok 5가 출시됐다”는 잘못된 헤드라인이 계속 나왔다.