AIREITER

Gemini 4 Argon API 가격과 사용 방법: 현재 공개된 내용

마지막 업데이트: 2026-10-01 07:30:31

Google이 Gemini 4 Argon을 발표했지만, 발표됐다는 사실과 실제로 호출할 수 있다는 것은 별개입니다. 2026년 10월 1일 기준 Google은 Argon을 먼저 신뢰할 수 있는 사이버 보안 방어 담당자에게 제공하고 있으며, 유료 API 고객과 Google AI Ultra 구독자가 그다음 대상입니다. 일반 공개 일정은 아직 나오지 않았습니다. 지금 할 일은 추측한 모델명을 코드에 박아 넣는 것이 아니라, 비용을 산정하고 평가 환경을 준비하는 것입니다.

Gemini 4 Argon은 발표됐지만 API가 일반 공개된 것은 아니다

Gemini 4 Argon은 실재하는 모델이며, Google DeepMind가 2026년 9월 30일 공식 발표했습니다. 다만 현재 공개 상태는 일반 출시가 아닌 제한적 액세스입니다. Google의 출시 발표에 따르면 첫 외부 제공 대상은 Fairwind Program에 참여하는 신뢰할 수 있는 사이버 보안 방어 담당자입니다. 이후 개발자, 기업, 소비자에게 “가능한 한 빨리” 제공할 예정이라고 밝혔습니다.

가격이 공개됐다고 해서 Argon이 여러분의 API 계정에서 바로 활성화된 것은 아닙니다. 확인되지 않은 엔드포인트나 모델 ID를 전제로 배포하지 마세요.

Google이 9월 30일 실제로 연 액세스 범위

현재 Google의 출시에는 다음 네 가지 경계가 있습니다.

액세스 대상2026년 10월 1일 기준 상태의미
Fairwind 신뢰 사이버 방어 담당자제공 시작방어적 사이버 보안 작업에 맞춘 버전의 초기 외부 액세스
Google 내부 팀이미 내부 사용 중내부 사용 사례일 뿐, 공개 API 사용 권한을 의미하지 않음
유료 Gemini API 고객 및 AI Ultra 구독자다음 대상, 일정 미정Google은 “가능한 한 빨리”라고 밝혔지만 구체적인 날짜는 제시하지 않음
일반 개발자, 기업, 소비자일정 미정Argon을 기준으로 프로덕션 출시 일정을 세울 근거가 없음

어느 항목에도 안정적인 공개 모델 ID, 레이트 리밋 일정, Google AI Studio 또는 Vertex AI 출시일은 포함되어 있지 않습니다.

공식 Gemini 4 Argon 발표는 출시 대상과 순서에 관한 기준 자료입니다. 실제로 호출 가능한 공개 요금표는 Google의 최신 Gemini API 가격 문서를 기준으로 확인해야 합니다. 확인 당시 Argon은 해당 문서에 등록되어 있지 않았습니다.

사용할 수 없는데 가격부터 공개된 Gemini 4 Argon API

Google은 토큰 100만 개당 출시 초기 가격을 발표했습니다. 출시 초기 기간이 끝나면 가격은 두 배가 되지만, 그 기간의 종료일은 아직 공개되지 않았습니다.

과금 항목출시 초기 가격이후 가격
입력 토큰$2.00 / 1M$4.00 / 1M
캐시 입력$0.10 / 1M, 95% 할인으로 안내미정
출력 토큰$10.00 / 1M$20.00 / 1M

입력 토큰 200,000개 중 150,000개가 캐시되고, 캐시되지 않은 입력이 50,000개, 출력이 40,000개인 단순 에이전트 호출을 가정하면 출시 초기 예상 비용은 $0.515입니다.

  1. 캐시되지 않은 입력 토큰 50,000개: $0.10
  2. 캐시 입력 토큰 150,000개: $0.015
  3. 출력 토큰 40,000개: $0.40
  4. 합계: 다른 제공업체 또는 플랫폼 비용을 제외하고 $0.515

공개된 이후 입력·출력 요금을 적용하면 캐시되지 않은 입력과 출력 비용은 $1.00입니다. 다만 Google이 이후 캐시 입력 가격을 밝히지 않았으므로 최종 합계는 알 수 없습니다. 비용에서 가장 큰 비중을 차지하는 것은 출력입니다. 따라서 출력 100만 토큰을 기본값으로 삼기보다는 상한선으로 보는 편이 맞습니다. 출시 초기 출력 요금 기준으로 $10, 이후에는 $20이 들며 입력 비용은 별도입니다.

출시 초기 가격만 보고 예산을 잡지 마세요. $2/$10에서는 작동하지만 $4/$20에서는 감당할 수 없는 기능이라면 프로덕션 준비가 된 것이 아닙니다. 레이트 리밋, 지역별 제공 여부, 배치 처리 조건, 최종 캐시 정책, 출시 초기 기간의 종료일은 아직 확인되지 않았습니다.

Argon 관련 공개 자료로 알 수 있는 것과 알 수 없는 것

Google은 Argon을 장기 소프트웨어 엔지니어링, 기업 지식 작업, 긴 동영상 이해, 방어적 사이버 보안에 적합한 모델로 소개하고 있습니다. 출시 자료에 제시된 결과는 다음과 같습니다.

평가공개된 결과해석의 범위
DeepSWE v1.177.9%Google이 공개한 소프트웨어 엔지니어링 결과
AutomationBench51.3%Google이 공개한 엔드투엔드 비즈니스 기능 결과
LVBench91.7%Google이 공개한 장시간 동영상 처리 결과
CWE-bench v168%Google이 공개한 취약점 수정 결과

Artificial Analysis는 고도 추론 스냅샷의 초기 Intelligence Index 점수로 53을 제시했으며, 속도 데이터는 아직 없다고 표시했습니다. 이는 참고 자료이지 지연 시간을 보장하는 수치가 아닙니다. Google의 벤치마크 결과는 작업별 테스트를 해볼 이유가 되지만, 모든 작업에서 우월하다고 가정할 근거는 아닙니다.

출력 100만 토큰 제한이 아키텍처를 바꾼다

Google에 따르면 Argon은 최대 100만 개의 출력 토큰을 생성할 수 있습니다. 기존 Gemini 모델의 64,000개에서 크게 늘어난 수치입니다. 대규모 마이그레이션이나 보고서를 여러 응답으로 나눠 이어 붙여야 하는 상황을 줄일 수 있다는 뜻입니다. 동시에 운영 측면에서는 세 가지 위험이 생깁니다.

첫째, 긴 응답은 작업 막바지에 실패할 수 있습니다. 출력을 스트리밍하고 중간 결과를 체크포인트로 저장해 연결이 끊겨도 거의 완료된 작업 전체가 무용지물이 되거나 비용만 남지 않게 하세요. 둘째, 출력이 길어질수록 검토 부담도 커집니다. 대규모 코드 마이그레이션에는 여전히 테스트, diff 검토, 롤백 경계가 필요합니다. 셋째, 출력량이 늘면 지연 시간도 증가하므로 매우 긴 생성은 대화형 UI와 잘 맞지 않습니다.

모든 호출에 명시적인 출력 상한을 설정하세요. 추출과 채팅에는 작은 제한을, 범위가 정해진 코드 변경에는 더 큰 제한을, 보고서나 마이그레이션에는 작업별 예산을 적용하면 됩니다. 100만 토큰 상한은 정말 필요한 작업에서 유용한 기능이지, 모든 에이전트를 제한 없이 실행하라는 뜻은 아닙니다.

개발자를 위한 안전한 마이그레이션 계획

Argon을 지금 사용할 수 있는 것처럼 전제하지 않아도 준비는 시작할 수 있습니다.

  1. 모델명을 애플리케이션 로직에 직접 넣지 말고 GEMINI_MODEL에 둡니다.
  2. GEMINI_API_KEY는 소스 관리 시스템에 포함하지 않습니다.
  3. 자체 저장소, 문서 또는 에이전트 실행 기록에서 대표 작업 20~50개를 구성합니다.
  4. 토큰 수, 지연 시간, 재시도, 도구 오류, 결과 채택 여부, 사람이 수정하는 데 걸린 시간, 실제 비용을 기록합니다.
  5. 액세스가 열리면 Google의 Models API 레퍼런스를 사용해 계정의 모델 목록을 확인합니다. gemini-4-argon을 추측해서 사용하지 마세요.
  6. 트래픽을 전환하기 전에 현재 프로덕션 모델로 동일한 테스트 세트를 다시 실행합니다.

Google의 Gemini API Python SDK 레퍼런스를 따르면 다음처럼 모델에 종속되지 않는 최소 Python 호출을 구성할 수 있습니다.

import os
from google import genai
from google.genai import types

client = genai.Client()
model = os.environ["GEMINI_MODEL"]

response = client.models.generate_content(
    model=model,
    contents="Review this bounded code change and list concrete risks.",
    config=types.GenerateContentConfig(max_output_tokens=32000),
)
print(response.text)

이 예제는 GEMINI_MODEL=gemini-4-argon이 현재 작동한다는 의미가 아닙니다. Google이 공식 ID를 공개한 뒤에는 배포를 변경하기 전에 모델 목록 응답과 API 문서가 동일한 내용을 가리키는지 확인하세요.

기다려야 할 사람과 지금 준비해야 할 사람

작업 유형현재 판단이유
대규모 리팩터링과 장시간 코딩 에이전트평가 환경 준비출력 상한과 DeepSWE 결과가 이 작업을 겨냥함
여러 문서를 다루는 법률·금융 분석평가 환경 준비기업 지식 작업과 지속적 추론이 출시 포지셔닝에 포함됨
짧은 고객 지원, 추출 또는 분류검증된 저렴한 모델 유지Argon의 높은 비용과 지연 시간이 투자 대비 효과를 내기 어려움
방어적 취약점 연구자격이 된다면 안내된 Fairwind 경로로 신청초기 액세스가 제한되어 있으며 사이버 보안 작업에 특화됨
이번 달 모델 출시가 필요한 제품Argon에 의존하지 않기공개 모델 ID와 일반 출시 일정이 모두 없음

현실적인 권장 전략은 전면 교체가 아니라 라우팅입니다. 일상적인 요청에는 빠른 기본 모델을 유지하고, Argon은 수용 기준 테스트를 통과한 뒤 길고 어려운 작업에만 배정하세요.

Gemini 4 Argon FAQ

Gemini 4 Argon은 누구나 사용할 수 있나요?

아니요. Google은 Fairwind를 통해 신뢰할 수 있는 사이버 보안 방어 담당자에게 먼저 제공하고 있습니다. 유료 API 고객과 Google AI Ultra 구독자가 다음 대상이라고 밝혔지만, 일반 공개 일정은 발표하지 않았습니다.

Gemini 4 Argon API 모델 ID는 무엇인가요?

2026년 10월 1일 확인한 출시 자료에는 안정적인 공개 모델 ID가 아직 나오지 않았습니다. gemini-4-argon이 유효하다고 가정하지 말고, 자신의 인증 정보로 사용할 수 있는 모델 목록을 조회하세요.

Gemini 4 Argon의 가격은 얼마인가요?

출시 초기 가격은 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $10입니다. Google은 이후 가격이 각각 $4와 $20이 된다고 밝혔으며, 캐시 입력에는 출시 초기 입력 가격 기준 95% 할인이 적용됩니다.

토큰 100만 개는 컨텍스트 윈도인가요?

Google이 명시한 것은 출력 토큰 제한입니다. API 문서에서 입력 제한을 밝히기 전까지 컨텍스트 윈도도 100만 토큰이라고 가정하지 마세요.

지금 Gemini 3.8 Flash를 교체해야 하나요?

아니요. 검증된 기본 모델을 유지하고 대표 테스트 세트를 고정한 뒤, Argon이 계정에서 사용 가능해지고 공식 모델 ID가 문서화되며 동일한 작업을 수용 가능한 비용과 수정률로 통과한 후에만 전환하세요.