Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

Gemini 3 Flash

Lanzamiento: 2025-12-17

chatVisiónCódigoLlamada a herramientasRazonamientoimageCaché de prompts

Gemini 3 Flash (preview) es el modelo que la documentación de Google describe como el mejor del mundo para la comprensión multimodal y su «modelo agéntico y de vibe coding más potente hasta la fecha», lanzado con la promesa de un rendimiento de clase frontera que rivaliza con modelos más grandes a una fracción del coste.

Entrada
texto imagen vídeo audio $0.5/M
Salida
texto $3/M
Entrada de audio
$1/M
Lectura de caché
$0.05/M
Contexto
1M
vs GPT-4o
~90% más barato
Corte de conocimiento
2025-01

Benchmarks

Sobre la media7 / 16
Gemini 3 Flash otros modelos medidos media de los modelos comparados ningún otro modelo puntuó más alto
ResearchRubrics
36.9%
GPQA Diamond
90.7%
BrowseComp
41.5%
Video-MME (w. sub)
85.2%

Publicado por los proveedores: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

El precio en contexto

Posición del precio entre 60 modelos comparables

Entrada$0.5/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Salida$3/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lectura en caché$0.05/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.

Especificaciones y límites

Tokens

Ventana de contexto (especificación del proveedor) 1.048.576
Salida máxima (especificación del proveedor) 65.536
Corte de conocimiento 2025-01

Caché de prompts

Modo automático + explícito
Prefijo mín. 4096

Razonamiento

Parámetro del proveedor thinkingLevel
Valores admitidos minimal · low · medium · high
Valor por defecto high se aplica si la solicitud no indica nada
Se puede desactivar No
Comportamiento del razonamiento Google afirma que Gemini 3 Flash no admite desactivar el pensamiento por completo, así que minimal es un mínimo y no un interruptor, y los tokens de pensamiento se facturan como tokens de salida en cada solicitud; las firmas de pensamiento deben devolverse tal cual y son obligatorias para la llamada a funciones.
Parámetro reasoning_effort
Valores minimal · low · medium · high la superficie de parámetros del gateway - aplica el mapeo del proveedor de arriba

Modelo

Modalidades texto + imagen + vídeo + audio → texto
  • Modelo en preview
  • 1.048.576 tokens de entrada
  • uso del ordenador admitido
  • la generación de imágenes NO está admitida pese a la etiqueta de capacidad del gateway

según documentación oficial de Google ↗

Use Gemini 3 Flash en 30 segundos

Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Acerca de Gemini 3 Flash

  • Acepta entrada de texto, imagen, vídeo, audio y PDF dentro de una ventana de contexto de 1.048.576 tokens y produce hasta 65.536 tokens de salida.
  • Las capacidades incluyen llamada a funciones, salidas estructuradas, ejecución de código, uso del ordenador, grounding de búsqueda y de Maps, contexto de URL, búsqueda de archivos, caché de contexto, la Batch API y la inferencia Flex y Priority.
  • El pensamiento se controla con thinking_level, que acepta minimal, low, medium y high y toma high por defecto, el valor por defecto más caro de la familia: en todos los modelos Gemini 3, minimal es un mínimo y no un interruptor de apagado, así que los tokens de pensamiento se facturan en cada solicitud.
  • La generación introdujo además las firmas de pensamiento, trazas cifradas del razonamiento interno que hay que devolver para preservar la continuidad entre varios turnos, junto con nuevos controles de resolución de medios, y ambas cosas son trabajo de migración y no extras opcionales al subir desde 2.5.
  • Como canal de vista previa no ofrece garantías de estabilidad; el sucesor estable de Google es gemini-3.5-flash, cuya página de modelo lista este ID como su alias de vista previa.
  • Synthorai lo ofrece a través de su interfaz unificada de chat completions compatible con OpenAI.

Preguntas frecuentes

¿Se puede probar gratis la API de Gemini 3 Flash?

Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $0.5/M por tokens de entrada, solo ese crédito cubre aproximadamente 250 solicitudes de ~8K tokens contra Gemini 3 Flash.

¿En qué destaca Gemini 3 Flash?

Descrito como el mejor para comprensión multimodal; razonamiento de vanguardia con fuerza en codificación creativa; soporte de uso del ordenador y grounding de Maps. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.

¿Cuánto cuesta Gemini 3 Flash?

Gemini 3 Flash cuesta $0.5 por millón de tokens de entrada y $3 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $0.05/M.

¿Gemini 3 Flash admite caché de prompts?

Sí: el caché automático viene activado por defecto, con un modo explícito para ahorros garantizados. Los tokens de entrada en caché se facturan a $0.05/M frente a $0.5/M sin caché; los prompts necesitan un prefijo estable de 4,096 tokens para entrar en caché. Guía de caché de prompts →

¿Cómo obtengo acceso a Gemini 3 Flash?

Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gemini-3-flash-preview" y listo. Una sola clave API cubre todos los modelos del gateway.

¿Cuál es la fecha de corte de conocimiento de Gemini 3 Flash?

La fecha de corte de conocimiento de Gemini 3 Flash es 2025-01, según la documentación oficial del proveedor (a fecha de 2026-07-09).

Modelos relacionados

Comparar

Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.

Obtén tu clave API Compare su costo →