Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

gemini-3.1-flash-lite-image vs GPT Image 2

vs

Qual usar e quando

Ambos são modelos de imagem que cobram os mesmos $30 por milhão de tokens de saída, então a verdadeira diferença está na entrada: o gemini-3.1-flash-lite-image aceita texto e imagens a $0.25 por milhão versus $5 do gpt-image-2, tornando 20x mais barato fornecer prompts e imagens de referência. Escolha o gemini-3.1-flash-lite-image para pipelines intensivos em prompts ou de imagem para imagem, onde o volume de entrada domina a fatura, e note que ele também pode retornar texto junto com as imagens, com um limite de saída de 4096 tokens e raciocínio que não pode ser desativado. Escolha o gpt-image-2 quando desejar um endpoint puramente de saída de imagem da OpenAI e o custo de entrada for um item de despesa menor.

Preços

gemini-3.1-flash-lite-image GPT Image 2 Δ
Entrada / 1M tokens $0.25 $5 0.05×
Saída / 1M tokens $30 $30 =

Tarifas do catálogo em tempo real, lidas no momento do build; a página de cada modelo traz a tabela de preços atual.

Onde cada um fica: preço de saída por 1M tokens entre os 9 modelos de geração de imagens com esta unidade de cobrança (escala logarítmica)

Especificações

gemini-3.1-flash-lite-image GPT Image 2
Modalidades de entrada texto imagem texto imagem
Modalidades de saída texto imagem imagem
Lançamento 2026-06-30 2026-04-21
Corte de conhecimento 2025-01 -
Tamanhos de saída 1K only (1:1 = 1024x1024)
  • 1024x1024
  • 1536x1024
  • 1024x1536
  • 2048x2048
  • 2048x1152
  • 3840x2160
  • 2160x3840
  • auto
  • arbitrary WxH (both divisible by 16, aspect ratio 1:3-3:1)
Modos de entrada text-to-image, interleaved generation + editing, up to 14 reference images text-to-image, image edit with mask inpainting
Imagens por requisição - 10
Formatos - png, jpeg, webp
Notas

1K (1024px) output only

10 aspect ratios (1:1, 3:2, 2:3, 3:4, 4:3, 4:5, 5:4, 9:16, 16:9, 21:9) and up to 14 reference images

interleaved generation and editing with fast multi-turn local edits

sub-2s end-to-end latency

SynthID + C2PA watermarking always on

Flexible resolutions: edges up to 3840px in multiples of 16, ratio <=3:1, ~0.65-8.3MP total (incl. 4K 3840x2160)

editing with mask inpainting

all image inputs processed at high fidelity

significantly improved text rendering (precise placement can still struggle)

As especificações são transcritas da documentação de cada provedor; quando um provedor não publica um dado, a linha é omitida, e não inferida. Fontes completas: gemini-3.1-flash-lite-image · GPT Image 2

Um prompt, os dois modelos, medidos pelo gateway

PROMPT A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-3.1-flash-lite-image

gemini-3.1-flash-lite-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Retornado pelo modelo 1408×768 latência 3 s

GPT Image 2

GPT Image 2: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

Retornado pelo modelo 1402×1122 latência 18 s

Um prompt, uma requisição por modelo, sem novas tentativas e sem escolher o melhor resultado: é o primeiro que cada modelo retornou. Nem o tamanho nem a duração foram fixados; cada modelo usou seu próprio padrão, porque uma requisição ajustada para servir a todos não mostraria o melhor de nenhum. Os arquivos foram recodificados para a web, então avalie a composição e a aderência ao prompt, e não a compressão.

Troque de um para o outro mudando uma linha

Os dois ids estão em todas as abas abaixo; o par de linhas destacado é a única alteração. O endpoint, a chave e o formato da requisição são os mesmos.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-3.1-flash-lite-image",
    # model="gpt-image-2",  # descomente esta linha, comente a linha acima
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

Obtenha sua chave de API →

Perguntas frequentes

Qual é mais barato, gemini-3.1-flash-lite-image ou GPT Image 2?

gemini-3.1-flash-lite-image sai mais barato na linha “Entrada / 1M tokens” ($0.25 contra $5, 20× de diferença). Outras linhas podem pender para o outro lado: a tabela acima mostra todos os preços, e o custo real depende do seu mix de uso.

Posso fazer um teste A/B de gemini-3.1-flash-lite-image contra GPT Image 2 sem duas integrações?

Sim. Os dois são servidos pelo mesmo endpoint compatível com OpenAI, com uma única chave de API. Para trocar, basta mudar uma linha, a string do modelo; assim você pode direcionar uma parte do tráfego para cada um e comparar as contas diretamente.

O preço muda com o tamanho da imagem?

Depende de como o modelo cobra. Os modelos com preço por imagem cobram o mesmo valor, seja qual for o prompt ou o tamanho da saída; nos modelos cobrados por token, o custo cresce com a resolução gerada, então uma imagem 4K custa várias vezes o preço de uma pequena. A tabela acima mostra qual é o caso de cada um.

Comparações relacionadas

Dos nossos estudos com medições