gemini-3.1-flash-lite-image vs GPT Image 2
Welches Modell wofür
Beide sind Bildmodelle, die die gleichen $30 pro Million Output-Token berechnen, daher liegt der wahre Unterschied beim Input: gemini-3.1-flash-lite-image nimmt Text und Bilder für $0.25 pro Million entgegen, im Vergleich zu $5 bei gpt-image-2, was es 20x günstiger macht, Prompts und Referenzbilder einzuspeisen. Wählen Sie gemini-3.1-flash-lite-image für Prompt-lastige oder Image-in-Image-out-Pipelines, bei denen das Input-Volumen die Rechnung dominiert, und beachten Sie, dass es neben Bildern auch Text zurückgeben kann, mit einem Output-Limit von 4096 Token und einem Denken, das sich nicht abschalten lässt. Wählen Sie gpt-image-2, wenn Sie einen reinen Image-out-Endpoint von OpenAI wünschen und die Input-Kosten ein kleiner Posten sind.
Preise
| gemini-3.1-flash-lite-image | GPT Image 2 | Δ | |
|---|---|---|---|
| Eingabe / 1M Tokens | $0.25 | $5 | 0.05× |
| Ausgabe / 1M Tokens | $30 | $30 | = |
Preise aus dem Live-Katalog, Stand des letzten Builds. Die aktuellen Preise stehen auf der jeweiligen Modellseite.
Einordnung: Ausgabepreis pro 1M Tokens aller 9 Bildgenerierung-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)
Spezifikationen
| gemini-3.1-flash-lite-image | GPT Image 2 | |
|---|---|---|
| Eingabemodalitäten | Text Bild | Text Bild |
| Ausgabemodalitäten | Text Bild | Bild |
| Veröffentlicht | 2026-06-30 | 2026-04-21 |
| Knowledge-Cutoff | 2025-01 | - |
| Ausgabegrößen | 1K only (1:1 = 1024x1024) |
|
| Eingabemodi | text-to-image, interleaved generation + editing, up to 14 reference images | text-to-image, image edit with mask inpainting |
| Bilder pro Anfrage | - | 10 |
| Formate | - | png, jpeg, webp |
| Anmerkungen | 1K (1024px) output only 10 aspect ratios (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9) and up to 14 reference images interleaved generation and editing with fast multi-turn local edits sub-2s end-to-end latency SynthID + C2PA watermarking always on | Flexible resolutions: edges up to 3840px in multiples of 16, ratio <=3:1, ~0.65-8.3MP total (incl. 4K 3840x2160) editing with mask inpainting all image inputs processed at high fidelity significantly improved text rendering (precise placement can still struggle) |
Die Spezifikationen stammen aus der Dokumentation des jeweiligen Anbieters. Veröffentlicht ein Anbieter eine Angabe nicht, lassen wir die Zeile weg, statt sie zu schätzen. Vollständige Quellen: gemini-3.1-flash-lite-image · GPT Image 2
Ein Prompt, beide Modelle, gemessen über das Gateway
Ein Prompt, eine Anfrage pro Modell, keine Wiederholungen und keine Auswahl der besten Ergebnisse: Sie sehen das erste Ergebnis, das jedes Modell geliefert hat. Größe und Dauer haben wir nicht vorgegeben. Jedes Modell hat seinen eigenen Standardwert verwendet, denn eine Anfrage, die auf alle zugeschnitten ist, würde keinem gerecht. Die Dateien wurden für das Web neu kodiert. Beurteilen Sie deshalb Bildaufbau und Prompt-Treue, nicht die Kompression.
Eine Zeile genügt für den Wechsel
Beide IDs stehen in jedem Tab unten. Die beiden hervorgehobenen Zeilen sind die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiches Anfrageformat.
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.images.generate(
model="gemini-3.1-flash-lite-image",
# model="gpt-image-2", # diese Zeile einkommentieren, die darüberliegende auskommentieren
prompt="a watercolor lighthouse at dawn",
size="1024x1024",
)
print(resp.data[0].b64_json[:80])import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.images.generate({
model: "gemini-3.1-flash-lite-image",
// model: "gpt-image-2", // diese Zeile einkommentieren, die darüberliegende auskommentieren
prompt: "a watercolor lighthouse at dawn",
size: "1024x1024",
});
console.log(resp.data?.[0]?.b64_json?.slice(0, 80));curl https://synthorai.io/v1/images/generations \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.1-flash-lite-image",
# "model": "gpt-image-2", # diese Zeile einkommentieren, die darüberliegende auskommentieren
"prompt": "a watercolor lighthouse at dawn",
"size": "1024x1024"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Images.Generate(context.TODO(), openai.ImageGenerateParams{
Model: "gemini-3.1-flash-lite-image",
// Model: "gpt-image-2", // diese Zeile einkommentieren, die darüberliegende auskommentieren
Prompt: "a watercolor lighthouse at dawn",
Size: "1024x1024",
})
fmt.Println(resp.Data[0].B64JSON[:80])
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.images.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ImagesResponse resp = client.images().generate(
ImageGenerateParams.builder()
.model("gemini-3.1-flash-lite-image")
// .model("gpt-image-2") // diese Zeile einkommentieren, die darüberliegende auskommentieren
.prompt("a watercolor lighthouse at dawn")
.size("1024x1024")
.build());
System.out.println(resp.data().orElseThrow().get(0).b64Json().orElseThrow().substring(0, 80));FAQ
Welches Modell ist günstiger: gemini-3.1-flash-lite-image oder GPT Image 2?
gemini-3.1-flash-lite-image ist bei Eingabe / 1M Tokens günstiger ($0.25 vs. $5, Faktor 20). Bei anderen Zeilen kann es umgekehrt sein. Die Tabelle oben zeigt alle Preise, und die tatsächlichen Kosten hängen von Ihrem Mix ab.
Kann ich gemini-3.1-flash-lite-image gegen GPT Image 2 A/B-testen, ohne zweimal zu integrieren?
Ja. Beide laufen über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel. Für den Wechsel ändern Sie nur eine Zeile, den Modellnamen. So können Sie einen Teil des Traffics an jedes Modell schicken und die Kosten direkt vergleichen.
Ändert sich der Preis mit der Bildgröße?
Das hängt davon ab, wie das Modell abrechnet. Modelle mit Preis pro Bild kosten immer gleich viel, egal wie lang der Prompt oder wie groß die Ausgabe ist. Bei Modellen mit Token-Abrechnung steigt der Preis mit der Auflösung, ein 4K-Bild kostet also ein Vielfaches eines kleinen. Die Tabelle oben zeigt, was für welches Modell gilt.