🎁 Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

Gemini 3.6 Flash

Google chat vision code tools
Entrada$1.5/M
Salida$7.5/M
Entrada de audio$5/M
Lectura de caché$0.15/M
Contexto1M
vs GPT-4o~70% más barato

Precios de lista del proveedor, sin margen de plataforma, pago por uso. Estos son los precios de lista oficiales. Los clientes con sesión iniciada pueden ver los precios efectivos con descuentos del espacio de trabajo en /console/pricing. Precio de entrada efectivo con una tasa de aciertos de caché del 70%:$0.555/M. La caché implícita está activada por defecto en los modelos Gemini actuales (con descuento automático en los aciertos de caché), además de una API explícita CachedContent con facturación basada en almacenamiento para un ahorro garantizado.

Use Gemini 3.6 Flash en 30 segundos

Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.6-flash",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Acerca de Gemini 3.6 Flash

Inteligencia de frontera más rápida y económica
Menor uso de tokens que 3.5 Flash según Google
Contexto 1 M, Computer Use integrado

Gemini 3.6 Flash es un modelo de disponibilidad general (GA) que la documentación de Google posiciona como inteligencia de nivel frontera sostenida para la era agéntica, optimizado para mayor velocidad y menor costo: la doc indica mayor rendimiento en tareas agénticas y multimodales complejas reduciendo el uso de tokens, a un precio inferior al de 3.5 Flash.

  • Admite razonamiento y el conjunto de herramientas integradas incluido Computer Use, acepta texto, imagen, vídeo y audio, con contexto de 1 M de tokens y hasta 65.536 tokens de salida; la página del modelo señala que temperature, top_p y top_k quedan obsoletos y se ignoran a partir de esta generación.
  • Synthorai lo sirve a través de su endpoint de chat compatible con OpenAI.

Especificaciones y límites

Salida máxima (especificación del proveedor)65,536
Modalidadestext + image + video + audio → text
Funcionestools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
DestacadoGA; 1M-token context, 64K max output; thinking plus the full built-in tool suite including Computer Use; officially positioned as stronger on complex agentic and multimodal tasks with lower token usage than 3.5 Flash. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Caché de promptsautomático + explícito · prefijo mínimo de 1,024 tokens

según documentación oficial de Google ↗

Preguntas frecuentes

¿Se puede probar gratis la API de Gemini 3.6 Flash?

Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $1.5/M por tokens de entrada, solo ese crédito cubre aproximadamente 83 solicitudes de ~8K tokens contra Gemini 3.6 Flash.

¿En qué destaca Gemini 3.6 Flash?

Inteligencia de frontera más rápida y económica, además de menor uso de tokens que 3.5 Flash según Google y contexto 1 M, Computer Use integrado. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.

¿Cuánto cuesta Gemini 3.6 Flash?

Gemini 3.6 Flash cuesta $1.5 por millón de tokens de entrada y $7.5 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $0.15/M.

¿Gemini 3.6 Flash admite caché de prompts?

Sí: el caché automático viene activado por defecto, con un modo explícito para ahorros garantizados. Los tokens de entrada en caché se facturan a $0.15/M frente a $1.5/M sin caché; los prompts necesitan un prefijo estable de 1,024 tokens para entrar en caché. Guía de caché de prompts →

¿Cómo obtengo acceso a Gemini 3.6 Flash?

Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gemini-3.6-flash" y listo. Una sola clave API cubre todos los modelos del gateway.

Modelos relacionados

Obtenga su clave API gratuita Compare su costo →