Neu Kostenlos registrieren und 10 Aufrufe gratis nutzen. Bis zu 1 $, ohne Kreditkarte.

gemini-3.1-flash-lite-image vs GPT Image 2

vs

Welches Modell wofür

Beide sind Bildmodelle, die die gleichen $30 pro Million Output-Token berechnen, daher liegt der wahre Unterschied beim Input: gemini-3.1-flash-lite-image nimmt Text und Bilder für $0.25 pro Million entgegen, im Vergleich zu $5 bei gpt-image-2, was es 20x günstiger macht, Prompts und Referenzbilder einzuspeisen. Wählen Sie gemini-3.1-flash-lite-image für Prompt-lastige oder Image-in-Image-out-Pipelines, bei denen das Input-Volumen die Rechnung dominiert, und beachten Sie, dass es neben Bildern auch Text zurückgeben kann, mit einem Output-Limit von 4096 Token und einem Denken, das sich nicht abschalten lässt. Wählen Sie gpt-image-2, wenn Sie einen reinen Image-out-Endpoint von OpenAI wünschen und die Input-Kosten ein kleiner Posten sind.

Preise

gemini-3.1-flash-lite-image GPT Image 2 Δ
Eingabe / 1M Tokens $0.25 $5 0.05×
Ausgabe / 1M Tokens $30 $30 =

Preise aus dem Live-Katalog, Stand des letzten Builds. Die aktuellen Preise stehen auf der jeweiligen Modellseite.

Einordnung: Ausgabepreis pro 1M Tokens aller 9 Bildgenerierung-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

Spezifikationen

gemini-3.1-flash-lite-image GPT Image 2
Eingabemodalitäten Text Bild Text Bild
Ausgabemodalitäten Text Bild Bild
Veröffentlicht 2026-06-30 2026-04-21
Knowledge-Cutoff 2025-01 -
Ausgabegrößen 1K only (1:1 = 1024x1024)
  • 1024x1024
  • 1536x1024
  • 1024x1536
  • 2048x2048
  • 2048x1152
  • 3840x2160
  • 2160x3840
  • auto
  • arbitrary WxH (both divisible by 16, aspect ratio 1:3-3:1)
Eingabemodi text-to-image, interleaved generation + editing, up to 14 reference images text-to-image, image edit with mask inpainting
Bilder pro Anfrage - 10
Formate - png, jpeg, webp
Anmerkungen

1K (1024px) output only

10 aspect ratios (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9) and up to 14 reference images

interleaved generation and editing with fast multi-turn local edits

sub-2s end-to-end latency

SynthID + C2PA watermarking always on

Flexible resolutions: edges up to 3840px in multiples of 16, ratio <=3:1, ~0.65-8.3MP total (incl. 4K 3840x2160)

editing with mask inpainting

all image inputs processed at high fidelity

significantly improved text rendering (precise placement can still struggle)

Die Spezifikationen stammen aus der Dokumentation des jeweiligen Anbieters. Veröffentlicht ein Anbieter eine Angabe nicht, lassen wir die Zeile weg, statt sie zu schätzen. Vollständige Quellen: gemini-3.1-flash-lite-image · GPT Image 2

Ein Prompt, beide Modelle, gemessen über das Gateway

PROMPT A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-3.1-flash-lite-image

gemini-3.1-flash-lite-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Vom Modell zurückgegeben 1408×768 Latenz 3 s

GPT Image 2

GPT Image 2: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Vom Modell zurückgegeben 1402×1122 Latenz 18 s

Ein Prompt, eine Anfrage pro Modell, keine Wiederholungen und keine Auswahl der besten Ergebnisse: Sie sehen das erste Ergebnis, das jedes Modell geliefert hat. Größe und Dauer haben wir nicht vorgegeben. Jedes Modell hat seinen eigenen Standardwert verwendet, denn eine Anfrage, die auf alle zugeschnitten ist, würde keinem gerecht. Die Dateien wurden für das Web neu kodiert. Beurteilen Sie deshalb Bildaufbau und Prompt-Treue, nicht die Kompression.

Eine Zeile genügt für den Wechsel

Beide IDs stehen in jedem Tab unten. Die beiden hervorgehobenen Zeilen sind die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiches Anfrageformat.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-3.1-flash-lite-image",
    # model="gpt-image-2",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

API-Schlüssel erstellen →

FAQ

Welches Modell ist günstiger: gemini-3.1-flash-lite-image oder GPT Image 2?

gemini-3.1-flash-lite-image ist bei Eingabe / 1M Tokens günstiger ($0.25 vs. $5, Faktor 20). Bei anderen Zeilen kann es umgekehrt sein. Die Tabelle oben zeigt alle Preise, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich gemini-3.1-flash-lite-image gegen GPT Image 2 A/B-testen, ohne zweimal zu integrieren?

Ja. Beide laufen über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel. Für den Wechsel ändern Sie nur eine Zeile, den Modellnamen. So können Sie einen Teil des Traffics an jedes Modell schicken und die Kosten direkt vergleichen.

Ändert sich der Preis mit der Bildgröße?

Das hängt davon ab, wie das Modell abrechnet. Modelle mit Preis pro Bild kosten immer gleich viel, egal wie lang der Prompt oder wie groß die Ausgabe ist. Bei Modellen mit Token-Abrechnung steigt der Preis mit der Auflösung, ein 4K-Bild kostet also ein Vielfaches eines kleinen. Die Tabelle oben zeigt, was für welches Modell gilt.

Verwandte Vergleiche

Aus unseren Studien mit eigenen Messungen