gemini-3.1-flash-lite-image vs GPT Image 2
Cuál usar y cuándo
Ambos son modelos de imagen que cobran los mismos $30 por millón de tokens de salida, por lo que la verdadera división está en la entrada: gemini-3.1-flash-lite-image acepta texto e imágenes a $0.25 por millón frente a $5 de gpt-image-2, haciéndolo 20x más barato para proporcionar prompts e imágenes de referencia. Elija gemini-3.1-flash-lite-image para pipelines intensivos en prompts o de imagen a imagen donde el volumen de entrada domine la factura, y tenga en cuenta que también puede devolver texto junto a las imágenes, con un límite de salida de 4096 tokens y un pensamiento que no se puede desactivar. Elija gpt-image-2 cuando desee un endpoint puramente de salida de imagen de OpenAI y el costo de entrada sea un gasto menor.
Precios
| gemini-3.1-flash-lite-image | GPT Image 2 | Δ | |
|---|---|---|---|
| Entrada / 1M tokens | $0.25 | $5 | 0.05× |
| Salida / 1M tokens | $30 | $30 | = |
Tarifas tomadas del catálogo en vivo al generar el sitio; la página de cada modelo tiene la ficha de precios actualizada.
Dónde queda cada uno: precio de salida por 1M de tokens entre los 9 modelos de generación de imágenes que se facturan en esta unidad (escala logarítmica)
Especificaciones
| gemini-3.1-flash-lite-image | GPT Image 2 | |
|---|---|---|
| Modalidades de entrada | texto imagen | texto imagen |
| Modalidades de salida | texto imagen | imagen |
| Lanzamiento | 2026-06-30 | 2026-04-21 |
| Corte de conocimiento | 2025-01 | - |
| Tamaños de salida | 1K only (1:1 = 1024x1024) |
|
| Modos de entrada | text-to-image, interleaved generation + editing, up to 14 reference images | text-to-image, image edit with mask inpainting |
| Imágenes por solicitud | - | 10 |
| Formatos | - | png, jpeg, webp |
| Notas | 1K (1024px) output only 10 aspect ratios (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9) and up to 14 reference images interleaved generation and editing with fast multi-turn local edits sub-2s end-to-end latency SynthID + C2PA watermarking always on | Flexible resolutions: edges up to 3840px in multiples of 16, ratio <=3:1, ~0.65-8.3MP total (incl. 4K 3840x2160) editing with mask inpainting all image inputs processed at high fidelity significantly improved text rendering (precise placement can still struggle) |
Las especificaciones se transcriben de la documentación de cada proveedor; si un proveedor no publica un dato, la fila se omite en vez de deducirlo. Fuentes completas: gemini-3.1-flash-lite-image · GPT Image 2
Un mismo prompt en los dos modelos, medido a través de la pasarela
Un prompt y una solicitud por modelo, sin reintentos y sin escoger el mejor resultado: lo que ves es lo primero que devolvió cada modelo. No fijamos ni el tamaño ni la duración; cada modelo usó sus valores por defecto, porque una solicitud hecha a la medida de todos no dejaría en buen lugar a ninguno. Los archivos se han recodificado para la web, así que fíjate en la composición y en la fidelidad al prompt, no en la compresión.
Cambia de uno a otro con una sola línea
Los dos ids aparecen en todas las pestañas de abajo; lo único que cambia es el par de líneas resaltadas. El endpoint, la clave y la estructura de la solicitud son los mismos.
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.images.generate(
model="gemini-3.1-flash-lite-image",
# model="gpt-image-2", # descomenta esta línea, comenta la de arriba
prompt="a watercolor lighthouse at dawn",
size="1024x1024",
)
print(resp.data[0].b64_json[:80])import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.images.generate({
model: "gemini-3.1-flash-lite-image",
// model: "gpt-image-2", // descomenta esta línea, comenta la de arriba
prompt: "a watercolor lighthouse at dawn",
size: "1024x1024",
});
console.log(resp.data?.[0]?.b64_json?.slice(0, 80));curl https://synthorai.io/v1/images/generations \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-image",
# "model": "gpt-image-2", # descomenta esta línea, comenta la de arriba
"prompt": "a watercolor lighthouse at dawn",
"size": "1024x1024"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Images.Generate(context.TODO(), openai.ImageGenerateParams{
Model: "gemini-3.1-flash-lite-image",
// Model: "gpt-image-2", // descomenta esta línea, comenta la de arriba
Prompt: "a watercolor lighthouse at dawn",
Size: "1024x1024",
})
fmt.Println(resp.Data[0].B64JSON[:80])
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.images.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ImagesResponse resp = client.images().generate(
ImageGenerateParams.builder()
.model("gemini-3.1-flash-lite-image")
// .model("gpt-image-2") // descomenta esta línea, comenta la de arriba
.prompt("a watercolor lighthouse at dawn")
.size("1024x1024")
.build());
System.out.println(resp.data().orElseThrow().get(0).b64Json().orElseThrow().substring(0, 80));Preguntas frecuentes
¿Cuál es más barato, gemini-3.1-flash-lite-image o GPT Image 2?
gemini-3.1-flash-lite-image es más barato en Entrada / 1M tokens ($0.25 frente a $5, una diferencia de 20×). En otras filas puede ser al revés: la tabla de arriba recoge todas las tarifas, y el coste real depende de tu combinación de uso.
¿Puedo hacer pruebas A/B de gemini-3.1-flash-lite-image frente a GPT Image 2 sin dos integraciones?
Sí. Los dos se sirven desde el mismo endpoint compatible con OpenAI y con una sola clave API. Para cambiar de uno a otro basta con tocar una línea, el nombre del modelo, así que puedes mandar una parte del tráfico a cada uno y comparar directamente las facturas.
¿Cambia el precio con el tamaño de la imagen?
Depende de cómo se facture el modelo. Los que cobran por imagen cuestan lo mismo sea cual sea el prompt o el tamaño de salida; en los que se facturan por tokens, el precio sube con la resolución que generes, así que una imagen 4K cuesta varias veces lo que una pequeña. La tabla de arriba indica qué caso es el de cada modelo.