🎁 Novo Cadastre-se grátis, 10 chamadas por nossa conta. Até US$ 1, sem cartão.

Gemini 3.5 Flash-Lite

Google chat vision code tools
Entrada$0.3/M
Saída$2.5/M
Entrada de áudio$0.3/M
Leitura de cache$0.03/M
Contexto1M
vs GPT-4o~94% mais barato

Preços de tabela do provedor: sem margem da plataforma, pagamento por uso. Estes são os preços de tabela oficiais. Clientes autenticados podem ver os preços efetivos com descontos do espaço de trabalho em /console/pricing. Entrada efetiva com taxa de acerto de cache de 70%:$0.111/M. O cache implícito vem ativado por padrão para os modelos Gemini atuais (com desconto automático em acertos de cache), além de uma API explícita CachedContent com cobrança baseada em armazenamento para economia garantida.

Use o Gemini 3.5 Flash-Lite em 30 segundos

Compatível com OpenAI: troque a base_url, mantenha seu SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Sobre o Gemini 3.5 Flash-Lite

O mais rápido e barato da família 3.5
Para subagentes e análise de alto rendimento
Contexto 1 M, raciocínio e ferramentas integradas

Gemini 3.5 Flash-Lite é um modelo multimodal de baixa latência em disponibilidade geral (GA) que a documentação do Google descreve como o modelo mais rápido e de menor custo da família 3.5, otimizado para execução de alto rendimento e baixo custo (tarefas de subagentes, análise de documentos).

  • Suporta raciocínio e as ferramentas integradas incluindo Computer Use, aceita texto, imagem, vídeo e áudio, com contexto de 1 M de tokens e até 65.536 tokens de saída; a página do modelo indica que temperature, top_p e top_k estão obsoletos e são ignorados a partir desta geração.
  • A Synthorai o serve pelo endpoint de chat compatível com OpenAI.

Especificações e limites

Saída máxima (especificação do fornecedor)65,536
Modalidadestext + image + video + audio → text
Recursostools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
DestaquesGA; 1M-token context, 64K max output; the fastest, lowest-cost model in the 3.5 family, optimized for high-throughput low-cost execution (subagent tasks, document parsing); thinking and built-in tools incl. Computer Use. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Cache de promptsautomático + explícito · prefixo mínimo de 1,024 tokens

conforme documentação oficial da Google ↗

Perguntas frequentes

A API do Gemini 3.5 Flash-Lite é gratuita para testar?

Sim. Contas novas recebem 10 chamadas de teste e até $1 em créditos gratuitos, sem precisar de cartão. A $0.3/M de tokens de entrada, só esse crédito já cobre cerca de 416 requisições de ~8K tokens ao Gemini 3.5 Flash-Lite.

Em que o Gemini 3.5 Flash-Lite é melhor?

O mais rápido e barato da família 3.5, além de para subagentes e análise de alto rendimento e contexto 1 M, raciocínio e ferramentas integradas. Veja a seção Sobre para o quadro completo, extraído das notas de lançamento do próprio fornecedor.

Quanto custa o Gemini 3.5 Flash-Lite?

Na Synthorai, o Gemini 3.5 Flash-Lite custa $0.3 por milhão de tokens de entrada e $2.5 por milhão de tokens de saída. É o preço de tabela do provedor, sem margem da plataforma. Tokens de entrada em cache são cobrados a $0.03/M.

O Gemini 3.5 Flash-Lite suporta cache de prompts?

Sim: o cache automático vem ativado por padrão, com um modo explícito para economia garantida. Tokens de entrada em cache são cobrados a $0.03/M, contra $0.3/M sem cache; os prompts precisam de um prefixo estável de 1,024 tokens para entrar em cache. Guia de cache de prompts →

Como obtenho acesso ao Gemini 3.5 Flash-Lite?

Aponte seu SDK da OpenAI existente para base_url="https://synthorai.io/v1", defina model="gemini-3.5-flash-lite" e pronto. Uma única chave de API cobre todos os modelos do gateway.

Modelos relacionados

Obtenha sua chave de API gratuita Compare seu custo →