DeepSeek에서 다음으로 주목할 것은 R2나 V5가 아닙니다. 바로 V4의 공식 출시 자체입니다. 여러 매체 보도에 따르면 DeepSeek는 공식 버전을 2026년 7월 중순에 출시하는 것을 목표로 하고 있으며, 단순한 외형상의 "GA" 표시와 달리 피크 시간대 API 요금과 더 강력한 에이전트형, 수학, 코드 성능이라는 두 가지 변화를 가져옵니다. 오늘 사용할 수 있는 deepseek-v4-pro와 deepseek-v4-flash는 여전히 4월 24일 프리뷰이며, 2026년 7월 20일 기준으로 공식 빌드는 DeepSeek의 변경 로그에 아직 나타나지 않았습니다. 이 글에서는 공식 버전이 무엇을 바꾸는지, 언제 공개되는지, 그리고 지금 구축할지 아니면 기다릴지를 살펴봅니다.
공식 DeepSeek V4가 바꿀 것
다가오는 공식 릴리스는 4월부터 제공되어 온 미리보기와 두 가지 면에서 다릅니다. 두 가지 모두 마케팅이 아니라 구체적인 사항입니다.
피크 시간대 요금제가 핵심입니다. 프런티어 LLM API로서는 여전히 드문 움직임으로, DeepSeek는 V4를 시간대별로 과금할 예정입니다. InfoWorld와 Let's Data Science에 따르면, 베이징의 업무 피크 시간대(09:00–12:00 및 14:00–18:00) 호출 요금은 비피크 요금의 두 배가 되며, 비피크 요금은 현재 수준을 유지합니다. 보도된 수치에 따르면 V4-Pro 출력은 비피크 시간대에 백만 토큰당 ¥6, 피크 시간대에는 ¥12이며, V4-Flash는 ¥2와 ¥4입니다. DeepSeek는 이를 단순한 요금 인상이 아니라 안정성을 위한 부하 분산으로 설명하지만, 실질적인 효과는 같습니다. 즉, 대화형 주간 트래픽은 더 비싸지고, 지연 허용이 가능하거나 비피크 시간대에 실행되는 배치 작업은 계속 저렴합니다. 시간대별 요금은 전기와 클라우드 스팟 시장에서는 일반적이지만, 이를 LLM API에서 보게 된다는 것은 이제 DeepSeek의 제약 조건이 학습이 아니라 추론 수요임을 보여줍니다.
성능이 향상됩니다. 같은 보고서는 공식 빌드가 더 강력한 agentic, 수학, 코드 생성 능력으로 preview를 확장하고, 1M-token context window를 전체 라인업에서 표준으로 만든다고 말합니다. 독립적인 벤치마크가 나올 때까지 정확한 폭은 검증되지 않은 것으로 보되, 방향성은 새로운 패밀리가 아니라 동일한 두 model ID 위에 얹힌 capability 향상입니다.
변하지 않는 것: 모델은 계속 open-weight로 유지되며, 여전히 deepseek-v4-pro 또는 deepseek-v4-flash를 호출합니다. 따라서 이번 공식 출시는 마이그레이션 이벤트가 아니라 가격과 품질에 관한 이벤트입니다.
공식 버전은 언제 출시되나요?
짧게 답하면: 2026년 7월 중순 시점으로 보고되었지만, 아직 출시가 확정되지는 않았습니다. 2026년 7월 20일 기준으로 그 시점은 이미 도달했거나 막 지났고, 공식 변경 로그에서 날짜가 있는 가장 최신 항목은 여전히 미리보기인 2026년 4월 24일입니다. 따라서 "V4가 7월에 출시된다"는 소문은 절반만 맞습니다. 공식 빌드가 보고되기는 했지만, 아직 문서에는 반영되어 있지 않습니다.
공식 버전이 또 다른 루머가 아니라 실제로 공개되었는지 알려주는 믿을 만한 신호는 두 가지입니다: 새로운 날짜가 표시된 변경 로그 항목과 공식 가격 페이지의 업데이트된 수치입니다. 이들이 바뀌면 출시된 것입니다. 그 전까지는 미리보기 버전입니다.
V4의 현재 비용과 공식 출시 이후 비용
가격 책정은 공식 출시에서 가장 큰 영향을 미치는 부분이므로, 먼저 현재 기준선을 이해해 두는 것이 중요합니다. 많은 소개 글에서 여전히 DeepSeek-V4-Pro의 출력 토큰 백만 개당 $3.48을 인용합니다. 이는 출시 당시 가격이었으며, 이미 오래전에 사라졌습니다.
DeepSeek의 공식 가격 페이지에 현재 표시된 가격은 다음과 같으며, 2026년 7월 20일에 확인되었습니다(모두 100만 토큰당, USD):
| 모델 | 입력(캐시 적중) | 입력(캐시 미적중) | 출력 |
|---|---|---|---|
| deepseek-v4-flash | $0.0028 | $0.14 | $0.28 |
| deepseek-v4-pro | $0.003625 | $0.435 | $0.87 |
Pro가 $3.48이 아니라 $0.87인 이유는 다음과 같습니다: 75% 출시 할인으로 원래 가격의 4분의 1 수준까지 내려갔고, 프로모션이 2026년 5월 31일에 종료된 뒤 DeepSeek는 그것이 원래대로 되돌아가도록 두지 않고 더 낮은 요금을 새로운 기준으로 유지했습니다.
이제 공식 출시를 그 위에 얹어 보겠습니다. 피크 시간대 요금이 적용되면, 오늘의 $0.87은 Pro의 비수기 하한이 되고, 영업시간 호출 비용은 대략 두 배가 됩니다. 9시부터 5시까지 사용자를 응대하는 챗봇에게는 이는 실제로 큰 증가이지만, 야간 배치 파이프라인에는 거의 아무런 변화가 없습니다. 지출을 그대로 유지하는 두 가지 레버는, 허용 가능한 작업을 비수기로 스케줄링하는 것과 캐시 히트 입력 요금에 의존하는 것인데, 이는 Pro에서의 캐시 미스보다 대략 50배 저렴합니다. 실제 워크로드를 모델링하고 있다면, DeepSeek 운영의 엔터프라이즈 비용 역학은 표시 가격보다 캐시 동작, 피크 구간, 처리량 제한에 더 크게 좌우됩니다.
이미 확정된 7월 24일 마감일
하나의 확정된 변경 사항은 소문이 아닙니다: 2026년 7월 24일 15:59 UTC에 기존 모델 이름 deepseek-chat 및 deepseek-reasoner가 종료됩니다. 코드가 여전히 이를 호출하고 있다면, 그 이후에는 작동하지 않습니다.
마이그레이션은 작으며, 지금 수행하면 공식 출시에서 사용할 모델 ID도 함께 적용할 수 있습니다:
model매개변수를deepseek-v4-flash또는deepseek-v4-pro로 변경하세요.- 동일한
base_url(https://api.deepseek.com)을 유지하세요; 이는 변경되지 않습니다. - 두 모델 모두 OpenAI ChatCompletions 인터페이스와 Anthropic 인터페이스를 통해 작동하므로, 클라이언트 라이브러리는 그대로 유지됩니다.
전환 기간 동안 이전 이름들은 deepseek-v4-flash의 non-thinking 및 thinking 모드에 매핑되므로, 이미 사실상 V4를 사용 중이며 — 별칭만 사라집니다. DeepSeek를 aggregator를 통해 라우팅하는 경우에도 모델 이름 변경은 동일합니다. AIReiter 같은 플랫폼은 같은 Anthropic-compatible endpoint를 통해 V4 ID를 제공합니다.
지금 미리보기 버전으로 개발할까요, 아니면 공식 버전을 기다릴까요?
대부분의 팀에게 정답은 지금 구축하는 것입니다 — 공식 출시가 이미 반영된 가격으로 말입니다.
미리보기는 프로덕션에 충분히 안정적이며, 비성수기 기준 출력 토큰 100만 개당 $0.87로 저렴합니다. V4-Pro는 최대 추론 설정(DeepSeek이 Pro-Max라고 부르는 모드)에서 SWE-bench Verified에서 약 80.6%로 보고되었으며, 이는 가장 강력한 폐쇄형 모델에 근접한 수치입니다. 다만 이러한 수치는 자체 보고이거나 제3자에 의한 것이며, 우리의 자체 테스트는 아니므로 그에 맞게 참고하시기 바랍니다. 비용 측면에서, Reddit 스레드 하나에서는 사람들이 다른 곳에서 지불하던 것보다 "17배 더 저렴하다"라고 그 매력을 요약했습니다.
공식 빌드를 기다리면 성능 향상을 얻을 수 있지만, 피크 시간대 요금도 함께 부담해야 하고, 7월 20일 현재 아직 변경 로그에 올라오지 않은 출시를 위한 작업도 지연됩니다. 실용적인 방법은 미리 보기 버전으로 배포하고, 대화형 트래픽의 피크 요금에 대비해 예산을 잡은 뒤, 공식 수치가 공개되면 다시 테스트하는 것입니다.
어떤 모델을 선택해야 할까요? Reddit의 개발자들은 범위가 명확한 작업에는 Flash를 "매우 저렴한 작업자"로 설명하며, 최첨단 수준의 추론에는 Pro를 사용합니다. Flash와 Pro의 트레이드오프는 바로 이러한 분리에 달려 있습니다. 어느 쪽을 선택하든 두 가지 주의점이 있습니다. V4-Pro의 처리량은 용량 제한을 받으며(DeepSeek도 그렇게 밝힌 바 있습니다), 따라서 Pro는 부하가 걸리면 더 느려질 수 있습니다. 또한 V4는 텍스트 전용입니다 — 이미지, 오디오, 비디오는 별도의 DeepSeek 라인(Janus, DeepSeek-VL2, DeepSeek-OCR)에 있으며, 공식 릴리스가 이를 바꿀 것으로 예상되지는 않습니다.
R2와 V5는 어떤가요?
검색량과는 달리, 단기적인 이야기로는 어느 쪽도 아닙니다. R2는 아직 출시되지 않았고 확정된 날짜도 없으며, DeepSeek는 구체적인 시기를 부인해 왔습니다. 또 유출된 "사양"들도 서로 모순됩니다(한 유출에서는 약 1.2T MoE 모델, 다른 유출에서는 32B dense 모델). V5는 더 희박합니다. 바이럴된 "7월 24일 V5" 주장은 기존 별칭 종료 날짜를 잘못 해석한 것입니다. 신뢰할 만한 다음 이정표는 이 글에서 다루는 것, 즉 새로운 세대가 아니라 공식 V4입니다.
자주 묻는 질문
공식 DeepSeek V4는 언제 출시되나요?
여러 매체가 2026년 7월 중순 출시 시점을 보도했지만, 2026년 7월 20일 기준으로 API 변경 로그에는 아직 나타나지 않았습니다. 실제로 출시되었는지 확인하려면 변경 로그와 가격 페이지를 확인하세요.
공식 V4와 미리보기 버전의 새로운 점은 무엇인가요?
두 가지: 피크 시간대 API 가격 책정(업무 시간 호출은 대체로 비피크 요금의 두 배)과 더 강력해진 agentic, 수학, 코드 성능, 그리고 전체 라인업에 걸친 1M context 표준화입니다. 모델 ID와 open-weight 라이선싱은 그대로 유지됩니다.
공식 DeepSeek V4의 가격은 얼마인가요?
비혼잡 시간대 요금은 오늘의 요금과 같을 것으로 예상됩니다: V4-Pro의 경우 100만 출력 토큰당 $0.87, V4-Flash의 경우 $0.28입니다. 피크 시간대 호출 비용은 그 약 두 배로 책정됩니다. 캐시 적중 입력은 ორივ 모두에서 훨씬 저렴합니다.
DeepSeek V4를 지금 바로 사용할 수 있나요?
네. V4-Pro와 V4-Flash는 2026년 4월 24일부터 공개되어 왔으며, 오픈 웨이트(MIT 라이선스, DeepSeek의 Hugging Face 조직에 있음)이고, 호출 가능했습니다. 이를 기반으로 개발하기 위해 공식 출시를 기다릴 필요가 없습니다.
2026년 7월 24일 이전에 마이그레이션해야 하나요?
코드가 아직도 deepseek-chat 또는 deepseek-reasoner를 호출하는 경우에만 해당합니다. 2026년 7월 24일 15:59 UTC 이전에 모델 이름을 deepseek-v4-flash 또는 deepseek-v4-pro로 변경하세요. 요청의 나머지 부분은 변경되지 않습니다.
