🎁 Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

Gemini 3.5 Flash-Lite

Google chat vision code tools
Entrada$0.3/M
Salida$2.5/M
Entrada de audio$0.3/M
Lectura de caché$0.03/M
Contexto1M
vs GPT-4o~94% más barato

Precios de lista del proveedor, sin margen de plataforma, pago por uso. Estos son los precios de lista oficiales. Los clientes con sesión iniciada pueden ver los precios efectivos con descuentos del espacio de trabajo en /console/pricing. Precio de entrada efectivo con una tasa de aciertos de caché del 70%:$0.111/M. La caché implícita está activada por defecto en los modelos Gemini actuales (con descuento automático en los aciertos de caché), además de una API explícita CachedContent con facturación basada en almacenamiento para un ahorro garantizado.

Use Gemini 3.5 Flash-Lite en 30 segundos

Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Acerca de Gemini 3.5 Flash-Lite

El más rápido y económico de la familia 3.5
Para subagentes y análisis de alto rendimiento
Contexto 1 M, razonamiento y herramientas integradas

Gemini 3.5 Flash-Lite es un modelo multimodal de baja latencia en disponibilidad general (GA) que la documentación de Google describe como el modelo más rápido y de menor costo de la familia 3.5, optimizado para ejecución de alto rendimiento y bajo costo (tareas de subagentes, análisis de documentos).

  • Admite razonamiento y las herramientas integradas incluido Computer Use, acepta texto, imagen, vídeo y audio, con contexto de 1 M de tokens y hasta 65.536 tokens de salida; la página del modelo indica que temperature, top_p y top_k quedan obsoletos y se ignoran a partir de esta generación.
  • Synthorai lo sirve a través de su endpoint de chat compatible con OpenAI.

Especificaciones y límites

Salida máxima (especificación del proveedor)65,536
Modalidadestext + image + video + audio → text
Funcionestools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
DestacadoGA; 1M-token context, 64K max output; the fastest, lowest-cost model in the 3.5 family, optimized for high-throughput low-cost execution (subagent tasks, document parsing); thinking and built-in tools incl. Computer Use. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Caché de promptsautomático + explícito · prefijo mínimo de 1,024 tokens

según documentación oficial de Google ↗

Preguntas frecuentes

¿Se puede probar gratis la API de Gemini 3.5 Flash-Lite?

Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $0.3/M por tokens de entrada, solo ese crédito cubre aproximadamente 416 solicitudes de ~8K tokens contra Gemini 3.5 Flash-Lite.

¿En qué destaca Gemini 3.5 Flash-Lite?

El más rápido y económico de la familia 3.5, además de para subagentes y análisis de alto rendimiento y contexto 1 M, razonamiento y herramientas integradas. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.

¿Cuánto cuesta Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite cuesta $0.3 por millón de tokens de entrada y $2.5 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $0.03/M.

¿Gemini 3.5 Flash-Lite admite caché de prompts?

Sí: el caché automático viene activado por defecto, con un modo explícito para ahorros garantizados. Los tokens de entrada en caché se facturan a $0.03/M frente a $0.3/M sin caché; los prompts necesitan un prefijo estable de 1,024 tokens para entrar en caché. Guía de caché de prompts →

¿Cómo obtengo acceso a Gemini 3.5 Flash-Lite?

Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gemini-3.5-flash-lite" y listo. Una sola clave API cubre todos los modelos del gateway.

Modelos relacionados

Obtenga su clave API gratuita Compare su costo →