Todos los modelos
Google

Gemini 3.8 Flash

El modelo multimodal estable y de alta eficiencia de Google para agentes, trabajo de software y grandes entradas de medios mixtos a un precio introductorio de nivel Flash.

Descripción general en inglés sencillo

Qué es realmente Gemini 3.8 Flash

Gemini 3.8 Flash combina una ventana de entrada de un millón de tokens con comprensión de texto, imágenes, vídeo, audio y PDF. Sus características nativas de API incluyen llamada a funciones, ejecución de código, base de búsqueda, búsqueda de archivos y salida estructurada.

El precio actual es promocional. Los equipos que comparen los costos anuales deben modelar tanto la tarifa introductoria como la tarifa más alta publicada que comienza en 2027, además de cualquier llamada de búsqueda o inmovilización.

Buen ajuste para

  • Agentes multimodales de alto volumen
  • Entradas largas de vídeo, audio, PDF y código
  • Equipos que optimizan la capacidad por costo de token

Comparación de categorías

Los hechos que importan para los modelos texto

Estas son especificaciones publicadas por el proveedor, no puntuaciones de referencia Cody. Siga las fuentes vinculadas para conocer los límites actuales y las excepciones específicas de los terminales.

ventana contextual
1.048.576 fichasMáximo contexto de trabajo y aviso combinado documentado por el proveedor.
Salida máxima
65.536 fichasLímite de respuestas publicado por el proveedor, cuando esté disponible.
límite de conocimiento
marzo de 2026; algunos dominios pueden retrasarse hasta enero de 2025Última fecha de conocimiento confiable publicada explícitamente por el proveedor del modelo. Las herramientas de búsqueda y conectadas pueden recuperar información más reciente pero no cambian el límite integrado del modelo.
Precio de entrada
Promoción de $0,75 / 1 millónPrecio de lista estándar actual por millón de tokens de entrada, a menos que se indique lo contrario.
Precio de salida
Promoción de $3,75 / 1 millónPrecio de lista estándar actual por millón de tokens de salida, a menos que se indique lo contrario.
Entradas
Texto, imagen, vídeo, audio, PDFTipos de medios aceptados por el punto final del modelo enumerado.
Herramientas y agentes
Funciones, búsqueda, ejecución de código, búsqueda de archivos.Herramientas nativas seleccionadas y capacidades de creación de agentes, no una lista exhaustiva.

Precios y comparaciones

Calcula tu coste

Indica tu uso. La estimación se actualiza al escribir.

Ejemplo: 6.000 tokens de entrada para 10 páginas y 500 para el resumen. La longitud varía; ajusta los valores.

Una ejecución envía tu entrada al modelo una vez y recibe una respuesta. Los tokens son fragmentos de texto: la entrada es lo que envías y la salida es la respuesta que recibes.

Opciones avanzadas

Gemini 3.8 Flash

Google

Total estimado (USD)

0,0064 US$

Para el uso indicado · USD · Precio de API, no de suscripción

Tokens de entrada
0,75 US$ por 1M de tokens
Tokens de salida
3,75 US$ por 1M de tokens
Cómo funciona esta estimación

Las estimaciones excluyen impuestos, herramientas, almacenamiento/escritura de caché, cuotas gratuitas y descuentos personalizados. En imágenes solo incluyen la salida, no el prompt ni las referencias. Los modos de calidad varían. Los ajustes no listados no se consideran gratuitos.

Acceso a API y proveedores

Dónde conseguir Gemini 3.8 Flash

Disponibilidad

Regiones y etapa de acceso

Disponible a través de Gemini API y Google AI Studio en regiones admitidas, con rutas Vertex y de puerta de enlace también disponibles.

Utilice la lista en vivo de regiones disponibles de Google y verifique las restricciones de funciones para la ruta seleccionada.

Consultar disponibilidad en vivo

Datos y entrenamiento

La ruta importa.

Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región.

Esta es una lectura concisa del material del proveedor citado, no un asesoramiento legal. Una puerta de enlace de terceros puede tener términos de almacenamiento, enrutamiento, capacitación y residencia diferentes a los de la API directa del fabricante del modelo.

Lea la política del proveedor.

Preguntas frecuentes

Preguntas frecuentes sobre Gemini 3.8 Flash

¿Qué es Gemini 3.8 Flash?

El modelo multimodal estable y de alta eficiencia de Google para agentes, trabajo de software y grandes entradas de medios mixtos a un precio introductorio de nivel Flash. Gemini 3.8 Flash combina una ventana de entrada de un millón de tokens con comprensión de texto, imágenes, vídeo, audio y PDF. Sus características nativas de API incluyen llamada a funciones, ejecución de código, base de búsqueda, búsqueda de archivos y salida estructurada.

¿Cuándo se lanzó Gemini 3.8 Flash?

Gemini 3.8 Flash se lanzó en 2 de septiembre de 2026 según los materiales del proveedor citados.

¿Dónde puedo acceder a Gemini 3.8 Flash?

Disponible a través de Gemini API y Google AI Studio en regiones admitidas, con rutas Vertex y de puerta de enlace también disponibles. Las rutas de acceso enumeradas en esta guía son Google y OpenRouter.

¿Cuánto cuesta Gemini 3.8 Flash?

Entrada de $0,75 · Salida de $3,75 / 1 millón de tokens. Precio introductorio del nivel pagado hasta el 31 de diciembre de 2026; Google enumera una entrada de $1,50 y una salida de $7,50 a partir del 1 de enero de 2027.

¿Dónde está disponible Gemini 3.8 Flash?

Disponible a través de Gemini API y Google AI Studio en regiones admitidas, con rutas Vertex y de puerta de enlace también disponibles. Utilice la lista en vivo de regiones disponibles de Google y verifique las restricciones de funciones para la ruta seleccionada.

¿Se utilizan mis datos API Gemini 3.8 Flash para capacitación?

Google dice que las indicaciones y respuestas pagadas de Gemini API no se utilizan para mejorar sus productos. Por lo general, se puede utilizar contenido de servicios no pagos, con un tratamiento diferente para los usuarios del EEE, el Reino Unido y Suiza; verifique los términos actuales para su cuenta y región. La política pertenece a la ruta del proveedor y a los términos de la cuenta, así que verifíquela nuevamente antes de usarla en producción.

Comparación de precios

USD por millón de tokens para las API indicadas con contexto estándar. Las tarifas de caché y contexto largo pueden variar. Se omiten modelos sin precios revisados compatibles; menor coste no significa mejor calidad.

Coste de tokens de entradapor 1M de tokens · USD
  1. 0,15 US$
    Mistral Small 4

    Mistral AI

  2. 0,75 US$
    Gemini 3.8 Flash

    Google

    Este modelo

  3. 4,00 US$
    GPT-5.6 Sol

    OpenAI

  4. 10,00 US$
    GPT-6 Astra

    OpenAI

  5. 10,00 US$
    Claude Fable 5.1

    Anthropic

Coste de tokens de salidapor 1M de tokens · USD
  1. 0,60 US$
    Mistral Small 4

    Mistral AI

  2. 3,75 US$
    Gemini 3.8 Flash

    Google

    Este modelo

  3. 20,00 US$
    GPT-5.6 Sol

    OpenAI

  4. 50,00 US$
    GPT-6 Astra

    OpenAI

  5. 50,00 US$
    Claude Fable 5.1

    Anthropic

Comparaciones relacionadas

Comparaciones cara a cara

  1. Gemini 3.8 Flash vs GPT-6 Astra

    El modelo más capaz de OpenAI para trabajos difíciles de un extremo a otro, que combina el razonamiento de frontera con una ventana de contexto de un millón de tokens y un amplio conjunto de herramientas de agente.

    Abrir comparación completa
  2. Gemini 3.8 Flash vs GPT-5.6 Sol

    El modelo general insignia de OpenAI para codificación, análisis y trabajo profesional difíciles, con una ventana de contexto muy grande y un amplio conjunto de herramientas nativas.

    Abrir comparación completa
  3. Gemini 3.8 Flash vs Claude Fable 5.1

    El modelo de frontera de Anthropic para trabajos de codificación y agencia ambiciosos y de larga duración, con una visión sólida y disponibilidad en el mercado empresarial.

    Abrir comparación completa
  4. Gemini 3.8 Flash vs Grok 4.6

    El modelo fronterizo de texto e imagen de SpaceXAI para codificación, tareas de agencia y trabajo de conocimiento, con herramientas directas web, X y de código.

    Abrir comparación completa
  5. Gemini 3.8 Flash vs Grok 4.20 Multi-Agent Beta

    Un modelo especializado de Grok que envía varios agentes de IA a investigar una pregunta difícil en paralelo y luego combina su trabajo en una respuesta investigada.

    Abrir comparación completa
  6. Gemini 3.8 Flash vs Inkling

    El gran modelo de pesos abiertos de Thinking Machines Lab para flujos de trabajo de razonamiento, codificación, herramientas, visión y audio personalizables.

    Abrir comparación completa
  7. Gemini 3.8 Flash vs Mistral Medium 3.5

    El modelo de frontera de peso abierto de Mistral para flujos de trabajo multimodales, de codificación, de razonamiento y de agentes exigentes, con una ventana de contexto de 256K.

    Abrir comparación completa
  8. Gemini 3.8 Flash vs Mistral Small 4

    El modelo abierto de menor costo de Mistral que combina el seguimiento de instrucciones normales, el razonamiento, la codificación, la visión y las herramientas del agente en un solo punto final.

    Abrir comparación completa
  9. Gemini 3.8 Flash vs Qwen3.8 Max

    Modelo Qwen de frontera de Alibaba para razonamiento, codificación, herramientas y comprensión de texto, imágenes y videos de contexto prolongado.

    Abrir comparación completa
  10. Gemini 3.8 Flash vs MiniMax M3

    Modelo multimodal de un millón de tokens de MiniMax para codificación, agentes, uso de computadoras y proyectos largos a un precio API directo bajo.

    Abrir comparación completa
  11. Gemini 3.8 Flash vs GLM-5.3

    Modelo de razonamiento abierto y de contexto largo de Z.ai para codificación, herramientas y trabajo de agencia en rutas autohospedadas y administradas.

    Abrir comparación completa
  12. Gemini 3.8 Flash vs Kimi K3

    Modelo multimodal de frontera de Moonshot AI para codificación de millones de tokens, razonamiento, trabajo de conocimiento y agentes basados ​​en herramientas.

    Abrir comparación completa
  13. Gemini 3.8 Flash vs Falcon-H1R-7B

    El modelo de razonamiento abierto y compacto de TII para tareas de texto, contextos extensos y flujos de trabajo de llamada de funciones autohospedados.

    Abrir comparación completa
  14. Gemini 3.8 Flash vs Falcon-H1-34B-Instruct

    Modelo de instrucción abierta 34B de TII para texto multilingüe, codificación y aplicaciones autohospedadas controladas.

    Abrir comparación completa
  15. Gemini 3.8 Flash vs Muse Spark 1.3

    El último modelo de razonamiento multimodal de Meta para agentes de larga duración, codificación, herramientas y colaboración compleja de usuarios.

    Abrir comparación completa
  16. Gemini 3.8 Flash vs Celeris-1 Magnus

    Modelo de lenguaje de difusión centrado en agentes Celeris para razonamiento rápido, bucles de herramientas, acciones estructuradas e integración compatible con OpenAI.

    Abrir comparación completa
  17. Gemini 3.8 Flash vs NVIDIA Nemotron 3 Ultra

    El modelo de razonamiento Nemotron 3 más grande de NVIDIA para agentes complejos, codificación, planificación, herramientas, RAG y análisis de millones de tokens.

    Abrir comparación completa
  18. Gemini 3.8 Flash vs NVIDIA Nemotron 3.5 Lightning

    El modelo compacto de combinación de expertos 30B de NVIDIA para agentes especializados eficientes y flujos de trabajo de texto de gran volumen.

    Abrir comparación completa
  19. Gemini 3.8 Flash vs Qwen3.8-Flash

    El eficiente modelo multimodal de millones de contextos de Alibaba para agentes rápidos, codificación, trabajo de documentos, visión, comprensión de videos y uso de herramientas.

    Abrir comparación completa
  20. Gemini 3.8 Flash vs DeepSeek-V4-Pro

    El modelo de texto insignia de un millón de contextos de DeepSeek para razonamiento difícil, codificación, agentes de larga duración, herramientas y resultados muy grandes.

    Abrir comparación completa
  21. Gemini 3.8 Flash vs DeepSeek-V4-Flash

    El modelo V4 de menor costo de DeepSeek para razonamiento, codificación, agentes y cargas de trabajo de texto de millones de tokens de gran volumen.

    Abrir comparación completa