Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

gemini-2.5-flash-image

Lanzamiento: 2025-08-26

imageVisiónCaché de prompts

Gemini 2.5 Flash Image, conocido como Nano Banana, es el modelo de generación y edición de imágenes de Google que la página oficial califica como su mejor motor para la creación visual de alta velocidad, con velocidad y eficiencia de vanguardia.

Entrada
texto imagen $0.3/M
Salida
imagen texto $30/M
Corte de conocimiento
2025-06

Benchmarks

gemini-2.5-flash-image: 22 publicados, pero ningún benchmark compartido con suficientes modelos para comparar.

gemini-2.5-flash-image otros modelos medidos media de los modelos comparados ningún otro modelo puntuó más alto
DreamEval Single-Image Editing Easy, avg
77.8%

Publicado por los proveedores: Amazon ByteDance

El precio en contexto

Posición del precio entre 8 modelos comparables

Entrada$0.3/M
$0.25 · gemini-3.1-flash-lite-image GPT Image 1 · $5
Salida$30/M
$8 · GPT Image 1 Mini Gemini 3 Pro Image (Preview) · $120

La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.

Especificaciones y límites

Tokens

Salida máxima (especificación del proveedor) 32.768
Corte de conocimiento 2025-06

Imagen

Tamaños
  • 1024x1024 (1:1)
  • 832x1248 (2:3)
  • 1248x832 (3:2)
  • 864x1184 (3:4)
  • 1184x864 (4:3)
  • 896x1152 (4:5)
  • 1152x896 (5:4)
  • 768x1344 (9:16)
  • 1344x768 (16:9)
  • 1536x672 (21:9)
Modos de entrada texto a imagen, edición conversacional de imágenes (entrada de imagen + texto)
Capacidades de imagen
  • Generación nativa de imágenes multimodal con edición conversacional de imágenes, optimizada para flujos de trabajo creativos de alto volumen y baja latencia
  • entrada de imagen y texto, salida de imagen y texto

Modelo

Modalidades texto + imagen → imagen + texto
  • Cosa inusual en un modelo de imagen, publica un corte de conocimiento (junio de 2025)
  • no admite llamada a funciones ni pensamiento

según documentación oficial de Google ↗

Un prompt, medido a través del gateway

PROMPT A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-2.5-flash-image

gemini-2.5-flash-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Devuelto por el modelo 1024×1024 latencia 7 s

Un prompt, una solicitud por modelo, sin reintentos y sin selección a dedo - el primer resultado que cada modelo devolvió. Ni el tamaño ni la duración se fijaron: cada modelo utilizó su propio valor por defecto, porque una solicitud diseñada para adaptarse a todos no favorecería a ninguno. Los archivos aquí están recodificados para la web, así que juzgue la composición y la adherencia al prompt, no la compresión.

Use gemini-2.5-flash-image en 30 segundos

Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/images/generations

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-2.5-flash-image",
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

Acerca de gemini-2.5-flash-image

  • Está diseñado para escenarios de alto volumen, edición conversacional de imágenes y flujos de trabajo de baja latencia, combinando la comprensión multimodal nativa de entrada de imagen y texto con salida de imagen y texto en 1K, 2K y 4K, con control de relación de aspecto añadido cuando el modelo alcanzó la disponibilidad general.
  • La edición sigue el patrón de la familia: refinamiento conversacional de varios turnos que arrastra la interacción anterior, añadiendo, eliminando o modificando elementos, enmascarado semántico para inpainting, transferencia de estilo y composición a partir de varias imágenes de referencia.
  • Los límites de tokens son 65.536 para la entrada y 32.768 para la salida, y se admiten las salidas estructuradas, la caché, el procesamiento por lotes y la inferencia Flex y Priority, mientras que no se admiten la llamada a funciones, el grounding de búsqueda ni el pensamiento, que es el techo práctico de cuánto razonará sobre una composición antes de dibujarla.
  • Cada generación lleva una marca de agua SynthID.
  • Google lo describe ahora como el pionero heredado de la serie Nano Banana y recomienda que el trabajo nuevo pase a Nano Banana 2 Lite para obtener mejor calidad, mayor velocidad y menor coste, así que conviene tratarlo como la opción de compatibilidad y no como la predeterminada.
  • Su fecha de corte de conocimiento es junio de 2025.
  • Synthorai lo sirve tras el mismo endpoint compatible con OpenAI que sus modelos de chat.

Preguntas frecuentes

¿Se puede probar gratis la API de gemini-2.5-flash-image?

Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. Suficiente para probar gemini-2.5-flash-image con su carga de trabajo real antes de añadir un método de pago.

¿En qué destaca gemini-2.5-flash-image?

El mejor motor para la creación visual de alta velocidad; edición conversacional de imágenes a baja latencia; velocidad y eficiencia de vanguardia. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.

¿Cuánto cuesta gemini-2.5-flash-image?

gemini-2.5-flash-image cuesta $0.3 por millón de tokens de entrada y $30 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma.

¿Cómo genero imágenes con la API de gemini-2.5-flash-image?

Envíe un POST a /v1/images/generations en Synthorai con model="gemini-2.5-flash-image". Es el formato de la API de imágenes de OpenAI, sin SDK del proveedor. Tamaños admitidos: 1024x1024 (1:1), 832x1248 (2:3), 1248x832 (3:2), 864x1184 (3:4), 1184x864 (4:3), 896x1152 (4:5), 1152x896 (5:4), 768x1344 (9:16), 1344x768 (16:9), 1536x672 (21:9).

¿Cómo obtengo acceso a gemini-2.5-flash-image?

Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gemini-2.5-flash-image" y listo. Una sola clave API cubre todos los modelos del gateway.

Modelos relacionados

Comparar

Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.

Obtén tu clave API Compare su costo →