Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

gemini-2.5-flash-image

Rilasciato 2025-08-26

imageVisioneCaching dei prompt

Gemini 2.5 Flash Image, noto come Nano Banana, è il modello di generazione ed editing di immagini di Google che la pagina ufficiale definisce il suo miglior motore per la creazione visiva ad alta velocità, con velocità ed efficienza allo stato dell'arte.

Input
testo immagine $0.3/M
Output
immagine testo $30/M
Cutoff di conoscenza
2025-06

Benchmark

gemini-2.5-flash-image: 22 pubblicati, ma nessun benchmark condiviso con abbastanza modelli per confrontare.

gemini-2.5-flash-image altri modelli misurati media dei modelli confrontati nessun altro modello ha fatto meglio
DreamEval Single-Image Editing Easy, avg
77.8%

Dati pubblicati dai fornitori: Amazon ByteDance

Il prezzo nel contesto

Posizione del prezzo tra 8 modelli comparabili

Input$0.3/M
$0.25 · gemini-3.1-flash-lite-image GPT Image 1 · $5
Output$30/M
$8 · GPT Image 1 Mini Gemini 3 Pro Image (Preview) · $120

La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.

Specifiche e limiti

Token

Output massimo (specifica del vendor) 32.768
Cutoff di conoscenza 2025-06

Immagine

Formati
  • 1024x1024 (1:1)
  • 832x1248 (2:3)
  • 1248x832 (3:2)
  • 864x1184 (3:4)
  • 1184x864 (4:3)
  • 896x1152 (4:5)
  • 1152x896 (5:4)
  • 768x1344 (9:16)
  • 1344x768 (16:9)
  • 1536x672 (21:9)
Modalità di input text-to-image, editing conversazionale delle immagini (immagine + testo in input)
Capacità immagine
  • Generazione di immagini multimodale nativa con editing conversazionale delle immagini, ottimizzata per flussi di lavoro creativi ad alto volume e bassa latenza
  • immagine+testo in input, immagine+testo in output

Modello

Modalità testo + immagine → immagine + testo
  • Insolitamente per un modello di immagini, pubblica un cutoff di conoscenza (giugno 2025)
  • function calling e thinking non supportati

fonte: documentazione ufficiale Google ↗

Un solo prompt, misurato attraverso il gateway

PROMPT A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-2.5-flash-image

gemini-2.5-flash-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Restituito dal modello 1024×1024 latenza 7 s

Un prompt, una richiesta per modello, nessun nuovo tentativo e nessun cherry-picking - il primo risultato restituito da ciascun modello. Né le dimensioni né la durata sono state fissate: ogni modello ha utilizzato il proprio default, perché una richiesta modellata per adattarsi a tutti non renderebbe giustizia a nessuno. I file qui sono stati ricodificati per il web, quindi valutate la composizione e l'aderenza al prompt, non la compressione.

Usa gemini-2.5-flash-image in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/images/generations

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-2.5-flash-image",
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

Informazioni su gemini-2.5-flash-image

  • È progettato per scenari ad alto volume, editing conversazionale delle immagini e flussi di lavoro a bassa latenza, e combina la comprensione multimodale nativa di input di immagini e testo con output di immagini e testo a 1K, 2K e 4K, con il controllo delle proporzioni aggiunto quando il modello è arrivato in disponibilità generale.
  • L'editing segue lo schema della famiglia: raffinamento conversazionale multi-turno che porta avanti l'interazione precedente, aggiunta, rimozione o modifica di elementi, mascheratura semantica per l'inpainting, style transfer e composizione a partire da più immagini di riferimento.
  • I limiti di token sono 65.536 in input e 32.768 in output, e sono supportati output strutturati, caching, elaborazione batch e inferenza Flex e Priority, mentre function calling, grounding con Search e thinking no, il che costituisce il tetto pratico di quanto ragionerà su un layout prima di disegnarlo.
  • Ogni generazione porta un watermark SynthID.
  • Google ora lo descrive come il pioniere legacy della serie Nano Banana e raccomanda di spostare il lavoro nuovo su Nano Banana 2 Lite per qualità migliore, velocità superiori e costo inferiore, quindi va trattato come l'opzione di compatibilità anziché come predefinito.
  • Il suo cutoff di conoscenza è giugno 2025.
  • Synthorai lo serve dietro lo stesso endpoint compatibile OpenAI dei suoi modelli di chat.

FAQ

L'API di gemini-2.5-flash-image si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. Abbastanza per provare gemini-2.5-flash-image sul tuo carico di lavoro reale prima di aggiungere un metodo di pagamento.

In cosa eccelle gemini-2.5-flash-image?

Miglior motore per la creazione visiva ad alta velocità; editing conversazionale delle immagini a bassa latenza; velocità ed efficienza allo stato dell'arte. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa gemini-2.5-flash-image?

Su Synthorai, gemini-2.5-flash-image costa $0.3 per milione di token in input e $30 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma.

Come genero immagini con l'API di gemini-2.5-flash-image?

Invia una POST a /v1/images/generations su Synthorai con model="gemini-2.5-flash-image": lo stesso formato dell'API images di OpenAI, senza SDK del vendor. Dimensioni supportate: 1024x1024 (1:1), 832x1248 (2:3), 1248x832 (3:2), 864x1184 (3:4), 1184x864 (4:3), 896x1152 (4:5), 1152x896 (5:4), 768x1344 (9:16), 1344x768 (16:9), 1536x672 (21:9).

Come ottengo l'accesso a gemini-2.5-flash-image?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gemini-2.5-flash-image" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Modelli correlati

Confronta

Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.

Ottieni la tua chiave API Confronta il tuo costo →