🎁 Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Gemini 3.5 Flash-Lite

Google chat vision code tools
Input$0.3/M
Output$2.5/M
Audio-Input$0.3/M
Cache-Read$0.03/M
Kontext1M
vs. GPT-4o~94% günstiger

Listenpreise der Anbieter, ohne Plattform-Aufschlag, nutzungsbasierte Abrechnung. Dies sind offizielle Listenpreise. Angemeldete Kunden sehen auf /console/pricing die effektiven Preise inklusive Workspace-Rabatten. Effektiver Input-Preis bei 70 % Cache-Trefferquote:$0.111/M. Implizites Caching ist bei aktuellen Gemini-Modellen standardmäßig aktiv (bei Cache-Treffern automatisch vergünstigt), dazu eine explizite CachedContent-API mit speicherbasierter Abrechnung für garantierte Einsparungen.

Gemini 3.5 Flash-Lite in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.5-flash-lite",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Über Gemini 3.5 Flash-Lite

Schnellstes, günstigstes Modell der 3.5-Familie
Für Hochdurchsatz-Subagenten und Parsing
1 Mio. Kontext, Thinking und integrierte Tools

Gemini 3.5 Flash-Lite ist ein allgemein verfügbares (GA) multimodales Modell mit niedriger Latenz, das Googles Dokumentation als das schnellste und günstigste Modell der 3.5-Familie beschreibt, optimiert für hohen Durchsatz bei geringen Kosten (Subagenten-Aufgaben, Dokumentenparsing).

  • Es unterstützt Thinking und die integrierten Tools inkl.
  • Computer Use, nimmt Text-, Bild-, Video- und Audioeingaben, 1 Mio.
  • Token Kontext und bis zu 65.536 Ausgabetokens; die Modellseite weist darauf hin, dass temperature, top_p und top_k ab dieser Generation veraltet sind und ignoriert werden.
  • Synthorai stellt es über seinen OpenAI-kompatiblen Chat-Endpunkt bereit.

Spezifikationen & Limits

Max. Output (Anbieter-Spezifikation)65,536
Modalitätentext + image + video + audio → text
Funktionentools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
BemerkenswertGA; 1M-token context, 64K max output; the fastest, lowest-cost model in the 3.5 family, optimized for high-throughput low-cost execution (subagent tasks, document parsing); thinking and built-in tools incl. Computer Use. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Prompt-Cachingautomatisch + explizit · min. 1,024-Token-Präfix

laut Offizielle Google-Dokumentation ↗

FAQ

Lässt sich die Gemini 3.5 Flash-Lite API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $0.3/M Input-Tokens deckt allein dieses Guthaben rund 416 Requests mit je ~8K Tokens gegen Gemini 3.5 Flash-Lite ab.

Worin ist Gemini 3.5 Flash-Lite am besten?

Schnellstes, günstigstes Modell der 3.5-Familie, außerdem für Hochdurchsatz-Subagenten und Parsing und 1 Mio. Kontext, Thinking und integrierte Tools. Das vollständige Bild finden Sie im About-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet Gemini 3.5 Flash-Lite?

Gemini 3.5 Flash-Lite kostet auf Synthorai $0.3 pro Million Input-Tokens und $2.5 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $0.03/M abgerechnet.

Unterstützt Gemini 3.5 Flash-Lite Prompt-Caching?

Ja, automatisches Caching ist standardmäßig aktiv, dazu ein expliziter Modus für garantierte Einsparungen. Gecachte Input-Tokens werden mit $0.03/M statt $0.3/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden. Prompt-Caching-Guide →

Wie erhalte ich Zugang zu Gemini 3.5 Flash-Lite?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gemini-3.5-flash-lite", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Verwandte Modelle

Kostenlosen API-Key holen Ihre Kosten vergleichen →