AIREITER

Precios de la API Gemini 3.8 Live: lo oficial en 2026

Última actualización: 2026-09-15 18:52:55

Que un modelo esté disponible oficialmente no significa que ya tenga una tarifa pública. Ese es el caso de Gemini 3.8 Live: Google anunció Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking el 15 de septiembre de 2026, pero su documentación todavía no publica un precio específico en dólares para 3.8 Live. No uses las tarifas de $0.75/$3.75 por tokens de Gemini 3.8 Flash para calcular el presupuesto de un agente de voz.

Gemini 3.8 Live existe, pero su precio de API aún no es público

La publicación de lanzamiento de Google indica que ambos modelos comenzaron a desplegarse para desarrolladores mediante Gemini API y Google AI Studio el 15 de septiembre de 2026. Eso confirma su disponibilidad, no una tarifa pública definitiva. El anuncio describe Gemini 3.8 Live como rentable y Extended Thinking como competitivamente priced, pero no detalla una tarifa por minuto ni por token de audio.

PreguntaRespuesta
¿Gemini 3.8 Live se ha lanzado oficialmente?Sí, Google lo anunció el 15 de septiembre de 2026.
¿Los desarrolladores pueden acceder?Google afirma que el despliegue comenzó a través de Gemini API y AI Studio.
¿Hay una tarifa oficial para 3.8 Live?No en la página de precios de Gemini API revisada para esta guía.
¿El precio de Gemini 3.8 Flash es lo mismo?No. gemini-3.8-flash y los modelos Live son identificadores de modelo distintos.
¿Se puede calcular hoy el coste exacto de una llamada con 3.8 Live?No, no sin un precio específico para la cuenta o una tarifa oficial posterior.

Los modelos que Google presentó el 15 de septiembre de 2026

Google presentó dos modelos de audio para diálogo en directo, cada uno orientado a un uso diferente. Gemini 3.8 Live busca conversaciones fluidas y escalables; Gemini 3.8 Live Extended Thinking está pensado para tareas complejas de varios pasos sin perder el hilo de la conversación.

El anuncio de lanzamiento habla de entrada visual casi en tiempo real, cambio automático entre 97 idiomas y llamadas a herramientas o APIs en segundo plano que pueden continuar mientras el modelo confirma la interacción al usuario. Extended Thinking se describe como capaz de razonar y hablar a la vez, mostrando señales de progreso en tareas más largas. Estas funciones influyen en el coste porque el trabajo en segundo plano, las llamadas a herramientas y un razonamiento más profundo pueden modificar el consumo de tokens.

Qué acceso tienen los compradores de la API

El despliegue de Google no es un interruptor único para todos. El anuncio oficial resume así las vías prácticas de acceso para desarrolladores:

PlataformaGemini 3.8 LiveGemini 3.8 Live Extended Thinking
Gemini APIEl despliegue comenzó el 15 de septiembre de 2026El despliegue comenzó el 15 de septiembre de 2026
Google AI StudioEl despliegue comenzó el 15 de septiembre de 2026El despliegue comenzó el 15 de septiembre de 2026
Gemini EnterpriseVista previa privadaVista previa privada

Interpreta esta tabla como la declaración de despliegue de Google, no como una garantía de que todas las cuentas verán de inmediato el mismo ID de modelo. La lista de modelos de la API y los permisos de tu proyecto son las comprobaciones operativas relevantes.

Cómo se factura Gemini Live API mientras no exista una tarifa para 3.8

La documentación de buenas prácticas de Live API de Google describe una facturación basada en tokens, no una cuota fija por sesión. El audio se convierte en consumo de tokens de audio; los mensajes de texto y las transcripciones generadas también pueden sumar consumo de tokens de texto. Además, una sesión prolongada puede encarecerse a medida que crece el contexto activo de la conversación.

Para presupuestar, estas son las reglas clave:

  1. No tomes los minutos de conexión como la unidad oficial de facturación. Una cifra por minuto es una estimación basada en la tokenización y el tiempo de habla.
  2. Distingue entre audio de entrada y audio de salida. El modelo puede escuchar durante diez minutos y hablar durante cuatro; son flujos de consumo distintos.
  3. Considera el crecimiento del contexto. La guía de Google advierte que el contexto acumulado de audio nativo puede incluirse en la facturación de turnos posteriores, según cómo se gestione el contexto.
  4. Suma la transcripción por separado cuando esté activada. Las transcripciones pueden añadir cargos por tokens de texto además del consumo de audio.
  5. Supervisa las llamadas a herramientas y los tokens de razonamiento. El trabajo en segundo plano puede consumir más tokens de salida o de contexto que un bot sencillo de turnos alternos.

Por eso, «medio céntimo por minuto» no sustituye a un precio oficial para 3.8. Puede describir una sola dirección de audio bajo una hipótesis concreta de tokenización.

Qué puedes presupuestar hoy

Hasta que Google publique las tarifas de Gemini 3.8 Live, utiliza los modelos Live con precios actuales como referencia de planificación, no como sustituto del precio del nuevo modelo. La documentación oficial de precios de Gemini recoge estas tarifas de referencia:

ModeloAudio de entradaAudio de salidaTexto de entradaTexto de salida
Gemini 3.1 Flash Live Preview$3.00 por 1M de tokens de audio (unos $0.005/min)$12.00 por 1M de tokens de audio (unos $0.018/min)$0.75 por 1M$4.50 por 1M
Gemini 2.5 Flash Native Audio$3.00 por 1M de tokens de audio$12.00 por 1M de tokens de audio$0.50 por 1M$2.00 por 1M
Gemini 3.5 Live Translate$3.50 por 1M de tokens de audio de entrada$21.00 por 1M de tokens de audio de salidaNo indicadoNo indicado

Como ejemplo de planificación, supón diez minutos de audio entrante y cuatro minutos de habla del modelo usando las estimaciones publicadas para Gemini 3.1 Flash Live:

  • Entrada: 10 × $0.005 = $0.05
  • Salida: 4 × $0.018 = $0.072
  • Subtotal de audio: $0.122

Es un cálculo de referencia, no una cotización para Gemini 3.8 Live. Excluye el contexto acumulado, la transcripción, las herramientas y cualquier nueva tarifa de 3.8. Las conversiones a minutos son estimaciones, así que para un presupuesto final debes usar el consumo de tokens que aparezca en tu propia respuesta de facturación.

Gemini 3.8 Flash estándar no es el modelo de Live API

El gemini-3.8-flash estándar de Google es un modelo con salida de texto y entrada multimodal. La página oficial de precios indica tarifas introductorias de $0.75 por 1 millón de tokens de entrada y $3.75 por 1 millón de tokens de salida hasta el 31 de diciembre de 2026, con tarifas programadas de $1.50/$7.50 a partir del 1 de enero de 2027.

Esos precios se aplican al modelo Flash estándar, no automáticamente a gemini-3.8-live ni a gemini-3.8-live-extended-thinking. La documentación de modelos diferencia Flash estándar de la capacidad Live. Comparten número de versión, pero Live necesita salida de audio en streaming, detección de turnos, gestión de interrupciones y comportamiento de sesión en tiempo real.

Una implementación segura debería registrar el ID exacto del modelo devuelto por el proveedor. Ver «Gemini 3.8» en un panel no es lo bastante preciso para atribuir costes.

¿Conviene crear ya sobre Gemini 3.8 Live?

Desarrolla un prototipo ahora si tu principal duda tiene que ver con el diseño de interacción: ¿los usuarios aceptarán el trabajo en segundo plano, las actualizaciones verbales de progreso, el contexto visual y las interrupciones dentro de tu flujo? Google ha anunciado esos comportamientos, y el despliegue en API/AI Studio ofrece a los desarrolladores una forma de probar la integración.

Retrasa un compromiso de costes para producción si tu caso de negocio depende de un margen fijo por minuto. La falta de una tarifa para 3.8, el impacto desconocido de la refacturación del contexto y la ausencia de datos independientes sobre latencia y fallos dejan demasiadas variables para proyectar una economía unitaria fiable.

Crea un sistema de medición de costes antes de desviar tráfico:

  1. Registra los ID exactos de modelo y las respuestas de la API.
  2. Captura minutos de audio de entrada, minutos de audio de salida, tokens de texto, tokens de pensamiento cuando se expongan, transcripción y llamadas a herramientas.
  3. Ejecuta sesiones cortas, medias y largas con el mismo conjunto de tareas.
  4. Compara el coste por tarea completada con éxito, no el coste por minuto conectado.
  5. Mantén una alternativa con un modelo Live que ya tenga precio hasta que Google publique la tarifa de 3.8.

Preguntas frecuentes sobre Gemini 3.8 Live API

¿Cuál es el precio oficial de Gemini 3.8 Live API?

El anuncio de lanzamiento de Google no indica un precio en dólares, y la documentación de precios revisada no proporciona una tarifa específica para 3.8 Live.

¿Gemini 3.8 Live es gratis en Google AI Studio?

Google afirma que el despliegue comenzó en AI Studio, pero el acceso, las cuotas y las condiciones del nivel gratuito son cuestiones distintas de un precio de API garantizado para producción. Consulta la disponibilidad del modelo y la página de facturación de tu cuenta.

¿Gemini 3.8 Flash es lo mismo que Gemini 3.8 Live?

No. gemini-3.8-flash es un modelo estándar independiente. Sus precios introductorios de $0.75/$3.75 por tokens no deben presentarse como el precio de una sesión de audio Live.

¿Gemini Live API cobra por minuto?

No como regla fundamental de facturación. Google documenta un cobro basado en tokens; las cifras por minuto son estimaciones calculadas a partir de las tarifas por token de audio y una duración de habla supuesta.

¿Una conversación larga con Live puede costar más con el tiempo?

Sí. El contexto activo de la conversación, los tokens de audio, la transcripción y la actividad de herramientas pueden afectar al consumo de turnos posteriores. Mide una sesión representativa en lugar de multiplicar la estimación de una llamada corta.

¿Qué diferencia hay entre Gemini 3.8 Live y Extended Thinking?

Google posiciona Gemini 3.8 Live para el diálogo fluido y escalable, con contexto visual. Extended Thinking está orientado al razonamiento más profundo de varios pasos mientras sigue hablando y comunicando el progreso.

¿Dónde está disponible Gemini 3.8 Live?

Google anunció el despliegue a través de Gemini API y AI Studio, mientras que el acceso empresarial se describió inicialmente como una vista previa privada. La disponibilidad puede variar según la cuenta y la región.

Por tanto, el presupuesto defendible hoy es un rango basado en las tarifas actuales de tokens Live y en el comportamiento medido de las sesiones, no un precio estimado por minuto de Gemini 3.8 Live. Revisa el cálculo cuando Google añada la tarifa oficial del modelo.