🎁 Novità Registrati gratis, 10 chiamate le offriamo noi. Fino a $1, senza carta.

Gemini 3.5 Flash-Lite

Google chat vision code tools
Input$0.3/M
Output$2.5/M
Input audio$0.3/M
Lettura cache$0.03/M
Contesto1M
vs GPT-4o~94% più economico

Prezzi di listino del provider: senza ricarico della piattaforma, pagamento a consumo. Questi sono i prezzi di listino ufficiali. I clienti autenticati possono vedere i prezzi effettivi, inclusi gli sconti workspace, su /console/pricing. Input effettivo con un tasso di cache hit del 70%:$0.111/M. Il caching implicito è attivo di default per i modelli Gemini attuali (scontato automaticamente sugli hit della cache), più un'API CachedContent esplicita con fatturazione basata sullo storage per risparmi garantiti.

Usa Gemini 3.5 Flash-Lite in 30 secondi

Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Informazioni su Gemini 3.5 Flash-Lite

Il più veloce ed economico della famiglia 3.5
Per subagenti e parsing ad alto throughput
Contesto 1 M, ragionamento e strumenti integrati

Gemini 3.5 Flash-Lite è un modello multimodale a bassa latenza in disponibilità generale (GA) che la documentazione di Google descrive come il modello più veloce e a minor costo della famiglia 3.5, ottimizzato per esecuzione ad alto throughput e basso costo (attività di subagenti, parsing di documenti).

  • Supporta il ragionamento e gli strumenti integrati incluso Computer Use, accetta testo, immagine, video e audio, con contesto da 1 M di token e fino a 65.536 token di output; la pagina del modello indica che temperature, top_p e top_k sono deprecati e ignorati da questa generazione.
  • Synthorai lo serve tramite il suo endpoint di chat compatibile con OpenAI.

Specifiche e limiti

Output massimo (specifica del vendor)65,536
Modalitàtext + image + video + audio → text
Funzionalitàtools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
Da notareGA; 1M-token context, 64K max output; the fastest, lowest-cost model in the 3.5 family, optimized for high-throughput low-cost execution (subagent tasks, document parsing); thinking and built-in tools incl. Computer Use. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Caching dei promptautomatico + esplicito · prefisso min 1,024 token

fonte: documentazione ufficiale Google ↗

FAQ

L'API di Gemini 3.5 Flash-Lite si può provare gratis?

Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $0.3/M token in input, quel credito da solo copre circa 416 richieste da ~8K token verso Gemini 3.5 Flash-Lite.

In cosa eccelle Gemini 3.5 Flash-Lite?

Il più veloce ed economico della famiglia 3.5, oltre a per subagenti e parsing ad alto throughput e contesto 1 M, ragionamento e strumenti integrati. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.

Quanto costa Gemini 3.5 Flash-Lite?

Su Synthorai, Gemini 3.5 Flash-Lite costa $0.3 per milione di token in input e $2.5 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.03/M.

Gemini 3.5 Flash-Lite supporta il caching dei prompt?

Sì: il caching automatico è attivo di default, con una modalità esplicita per risparmi garantiti. I token di input in cache si fatturano a $0.03/M contro $0.3/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token. Guida al caching dei prompt →

Come ottengo l'accesso a Gemini 3.5 Flash-Lite?

Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gemini-3.5-flash-lite" e hai finito: una sola chiave API copre tutti i modelli del gateway.

Modelli correlati

Ottieni la tua chiave API gratuita Confronta il tuo costo →