Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

gemini-3.1-flash-lite-image vs GPT Image 2

vs

Cuál usar y cuándo

Ambos son modelos de imagen que cobran los mismos $30 por millón de tokens de salida, por lo que la verdadera división está en la entrada: gemini-3.1-flash-lite-image acepta texto e imágenes a $0.25 por millón frente a $5 de gpt-image-2, haciéndolo 20x más barato para proporcionar prompts e imágenes de referencia. Elija gemini-3.1-flash-lite-image para pipelines intensivos en prompts o de imagen a imagen donde el volumen de entrada domine la factura, y tenga en cuenta que también puede devolver texto junto a las imágenes, con un límite de salida de 4096 tokens y un pensamiento que no se puede desactivar. Elija gpt-image-2 cuando desee un endpoint puramente de salida de imagen de OpenAI y el costo de entrada sea un gasto menor.

Precios

gemini-3.1-flash-lite-image GPT Image 2 Δ
Entrada / 1M tokens $0.25 $5 0.05×
Salida / 1M tokens $30 $30 =

Tarifas tomadas del catálogo en vivo al generar el sitio; la página de cada modelo tiene la ficha de precios actualizada.

Dónde queda cada uno: precio de salida por 1M de tokens entre los 9 modelos de generación de imágenes que se facturan en esta unidad (escala logarítmica)

Especificaciones

gemini-3.1-flash-lite-image GPT Image 2
Modalidades de entrada texto imagen texto imagen
Modalidades de salida texto imagen imagen
Lanzamiento 2026-06-30 2026-04-21
Corte de conocimiento 2025-01 -
Tamaños de salida 1K only (1:1 = 1024x1024)
  • 1024x1024
  • 1536x1024
  • 1024x1536
  • 2048x2048
  • 2048x1152
  • 3840x2160
  • 2160x3840
  • auto
  • arbitrary WxH (both divisible by 16, aspect ratio 1:3-3:1)
Modos de entrada text-to-image, interleaved generation + editing, up to 14 reference images text-to-image, image edit with mask inpainting
Imágenes por solicitud - 10
Formatos - png, jpeg, webp
Notas

1K (1024px) output only

10 aspect ratios (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9) and up to 14 reference images

interleaved generation and editing with fast multi-turn local edits

sub-2s end-to-end latency

SynthID + C2PA watermarking always on

Flexible resolutions: edges up to 3840px in multiples of 16, ratio <=3:1, ~0.65-8.3MP total (incl. 4K 3840x2160)

editing with mask inpainting

all image inputs processed at high fidelity

significantly improved text rendering (precise placement can still struggle)

Las especificaciones se transcriben de la documentación de cada proveedor; si un proveedor no publica un dato, la fila se omite en vez de deducirlo. Fuentes completas: gemini-3.1-flash-lite-image · GPT Image 2

Un mismo prompt en los dos modelos, medido a través de la pasarela

PROMPT A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-3.1-flash-lite-image

gemini-3.1-flash-lite-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Devuelto por el modelo 1408×768 latencia 3 s

GPT Image 2

GPT Image 2: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Devuelto por el modelo 1402×1122 latencia 18 s

Un prompt y una solicitud por modelo, sin reintentos y sin escoger el mejor resultado: lo que ves es lo primero que devolvió cada modelo. No fijamos ni el tamaño ni la duración; cada modelo usó sus valores por defecto, porque una solicitud hecha a la medida de todos no dejaría en buen lugar a ninguno. Los archivos se han recodificado para la web, así que fíjate en la composición y en la fidelidad al prompt, no en la compresión.

Cambia de uno a otro con una sola línea

Los dos ids aparecen en todas las pestañas de abajo; lo único que cambia es el par de líneas resaltadas. El endpoint, la clave y la estructura de la solicitud son los mismos.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-3.1-flash-lite-image",
    # model="gpt-image-2",  # descomenta esta línea, comenta la de arriba
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

Obtén tu clave API →

Preguntas frecuentes

¿Cuál es más barato, gemini-3.1-flash-lite-image o GPT Image 2?

gemini-3.1-flash-lite-image es más barato en Entrada / 1M tokens ($0.25 frente a $5, una diferencia de 20×). En otras filas puede ser al revés: la tabla de arriba recoge todas las tarifas, y el coste real depende de tu combinación de uso.

¿Puedo hacer pruebas A/B de gemini-3.1-flash-lite-image frente a GPT Image 2 sin dos integraciones?

Sí. Los dos se sirven desde el mismo endpoint compatible con OpenAI y con una sola clave API. Para cambiar de uno a otro basta con tocar una línea, el nombre del modelo, así que puedes mandar una parte del tráfico a cada uno y comparar directamente las facturas.

¿Cambia el precio con el tamaño de la imagen?

Depende de cómo se facture el modelo. Los que cobran por imagen cuestan lo mismo sea cual sea el prompt o el tamaño de salida; en los que se facturan por tokens, el precio sube con la resolución que generes, así que una imagen 4K cuesta varias veces lo que una pequeña. La tabla de arriba indica qué caso es el de cada modelo.

Comparativas relacionadas

De nuestros estudios con mediciones