🎁 Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

gemini-3.1-flash-lite-image vs wan2.7-image-pro

vs

Quale scegliere e quando — verdetto curato, non una tabella di benchmark

Questi due modelli fatturano in unità diverse — gemini-3.1-flash-lite-image addebita per token ($0.25 per milione in input, $30 per milione in output) mentre wan2.7-image-pro addebita $0.075 per chiamata — quindi nessuna conversione singola è onesta e dovresti confrontarli sulla base della tua media del formato di richiesta. Scegli gemini-3.1-flash-lite-image quando desideri ricevere testo insieme alle immagini da input di testo o immagini, con un limite di output di 4096 token e un knowledge cutoff del 2025-01. Scegli wan2.7-image-pro per generazioni puramente image-out in cui il prezzo fisso per chiamata rende i costi prevedibili indipendentemente dalla lunghezza del prompt.

Prezzi

gemini-3.1-flash-lite-image wan2.7-image-pro Δ
Per immagine generata $0.075
Input / 1M token $0.25
Output / 1M token $30

Questi due modelli fatturano in unità diverse, quindi non viene mostrato alcun Δ — convertirli richiederebbe un'assunzione che non abbiamo misurato. Ogni scheda è elencata sopra nella propria unità.

Specifiche

gemini-3.1-flash-lite-image wan2.7-image-pro
Modalità di input testo immagine testo immagine
Modalità di output testo immagine immagine
Rilascio 2026-06-30 2026-04-01
Cutoff di conoscenza 2025-01
Dimensioni di output 1K only (1:1 = 1024x1024)
  • 1K (1024x1024)
  • 2K (2048x2048, default)
  • 4K (4096x4096, text-to-image only)
  • custom WxH (t2i 768x768 – 4096x4096; editing/sets 768x768 – 2048x2048, ratio 1:8–8:1)
Modalità di input text-to-image, interleaved generation + editing, up to 14 reference images text-to-image, image editing (incl. bounding-box interactive edit), 0–9 reference images, text/image-to-image-set
Immagini per richiesta 12
Formati png
Note

1K (1024px) output only

10 aspect ratios (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9) and up to 14 reference images

interleaved generation and editing with fast multi-turn local edits

sub-2s end-to-end latency

SynthID + C2PA watermarking always on

4K text-to-image (max 4096x4096; editing max 2K), aspect ratios 1:8-8:1

instruction + click-to-edit editing

character-consistent sets up to 12 images

print-quality text rendering incl. formulas/tables

Le specifiche sono trascritte dalla documentazione di ciascun fornitore; una riga che un fornitore non pubblica viene omessa anziché essere dedotta. Fonti complete: gemini-3.1-flash-lite-image · wan2.7-image-pro

Un solo prompt, entrambi i modelli — misurati attraverso il gateway

PROMPT A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-3.1-flash-lite-image

gemini-3.1-flash-lite-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Restituito dal modello 1408×768 latenza 3 s

wan2.7-image-pro

wan2.7-image-pro: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Restituito dal modello 1024×1024 latenza 25 s

Un prompt, una richiesta per modello, nessun nuovo tentativo e nessun cherry-picking — il primo risultato restituito da ciascun modello. Né le dimensioni né la durata sono state fissate: ogni modello ha utilizzato il proprio default, perché una richiesta modellata per adattarsi a tutti non renderebbe giustizia a nessuno. I file qui sono stati ricodificati per il web, quindi valutate la composizione e l'aderenza al prompt, non la compressione.

Passa dall'uno all'altro con una sola riga

Entrambi gli id sono presenti in ogni scheda qui sotto — la coppia di righe evidenziata è l'unica modifica. Stesso endpoint, stessa chiave, stessa struttura della richiesta.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-3.1-flash-lite-image",
    # model="wan2.7-image-pro",  # decommenta questa riga, commenta quella sopra
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

Ottieni una chiave API →

FAQ

Qual è più economico, gemini-3.1-flash-lite-image o wan2.7-image-pro?

Fatturano in unità diverse, quindi non esiste un singolo numero onesto: gemini-3.1-flash-lite-image e wan2.7-image-pro appaiono ciascuno con la propria unità nella tabella sopra. Confrontali sul tuo carico di lavoro — il compromesso pratico è descritto nel verdetto in cima a questa pagina.

Posso fare un A/B test di gemini-3.1-flash-lite-image contro wan2.7-image-pro senza due integrazioni?

Sì. Entrambi sono serviti tramite lo stesso endpoint compatibile con OpenAI con una singola chiave API — il passaggio richiede la modifica della stringa del modello in una sola riga, quindi puoi instradare una frazione del traffico verso ciascuno e confrontare direttamente le fatture.

Il prezzo cambia in base alla dimensione dell'immagine?

Dipende da come il modello fattura. I modelli con fatturazione per immagine addebitano lo stesso importo indipendentemente dalla dimensione del prompt o dell'output; i modelli fatturati a token scalano con la risoluzione renderizzata, quindi un'immagine 4K costa un multiplo di una piccola. La tabella sopra mostra quale si applica a ciascuno.

Confronti correlati