🎁 Neu Kostenlos registrieren, 10 Aufrufe gratis. Bis zu 1 $, ohne Karte.

Gemini 3.6 Flash

Google chat vision code tools
Input$1.5/M
Output$7.5/M
Audio-Input$5/M
Cache-Read$0.15/M
Kontext1M
vs. GPT-4o~70% günstiger

Listenpreise der Anbieter, ohne Plattform-Aufschlag, nutzungsbasierte Abrechnung. Dies sind offizielle Listenpreise. Angemeldete Kunden sehen auf /console/pricing die effektiven Preise inklusive Workspace-Rabatten. Effektiver Input-Preis bei 70 % Cache-Trefferquote:$0.555/M. Implizites Caching ist bei aktuellen Gemini-Modellen standardmäßig aktiv (bei Cache-Treffern automatisch vergünstigt), dazu eine explizite CachedContent-API mit speicherbasierter Abrechnung für garantierte Einsparungen.

Gemini 3.6 Flash in 30 Sekunden nutzen

OpenAI-kompatibel: Tauschen Sie die base_url, behalten Sie Ihr SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.6-flash",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

Über Gemini 3.6 Flash

Frontier-Intelligenz schneller und günstiger
Laut Google weniger Tokenverbrauch als 3.5 Flash
1 Mio. Kontext, Computer Use integriert

Gemini 3.6 Flash ist ein allgemein verfügbares (GA) Modell, das Googles Dokumentation als anhaltende Intelligenz auf Frontier-Niveau für das agentische Zeitalter positioniert, optimiert für höhere Geschwindigkeit und geringere Kosten — laut Doku stärkere Leistung bei komplexen agentischen und multimodalen Aufgaben bei reduziertem Tokenverbrauch und niedrigerem Preis als 3.5 Flash.

  • Es unterstützt Thinking und die integrierte Tool-Suite inkl.
  • Computer Use, nimmt Text-, Bild-, Video- und Audioeingaben, 1 Mio.
  • Token Kontext und bis zu 65.536 Ausgabetokens; die Modellseite weist darauf hin, dass temperature, top_p und top_k ab dieser Generation veraltet sind und ignoriert werden.
  • Synthorai stellt es über seinen OpenAI-kompatiblen Chat-Endpunkt bereit.

Spezifikationen & Limits

Max. Output (Anbieter-Spezifikation)65,536
Modalitätentext + image + video + audio → text
Funktionentools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
BemerkenswertGA; 1M-token context, 64K max output; thinking plus the full built-in tool suite including Computer Use; officially positioned as stronger on complex agentic and multimodal tasks with lower token usage than 3.5 Flash. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Prompt-Cachingautomatisch + explizit · min. 1,024-Token-Präfix

laut Offizielle Google-Dokumentation ↗

FAQ

Lässt sich die Gemini 3.6 Flash API kostenlos testen?

Ja, neue Konten erhalten 10 Test-Calls und bis zu $1 kostenloses Guthaben, keine Kreditkarte erforderlich. Bei $1.5/M Input-Tokens deckt allein dieses Guthaben rund 83 Requests mit je ~8K Tokens gegen Gemini 3.6 Flash ab.

Worin ist Gemini 3.6 Flash am besten?

Frontier-Intelligenz schneller und günstiger, außerdem laut Google weniger Tokenverbrauch als 3.5 Flash und 1 Mio. Kontext, Computer Use integriert. Das vollständige Bild finden Sie im About-Abschnitt, direkt aus den offiziellen Release Notes des Anbieters.

Was kostet Gemini 3.6 Flash?

Gemini 3.6 Flash kostet auf Synthorai $1.5 pro Million Input-Tokens und $7.5 pro Million Output-Tokens. Das ist der Listenpreis des Anbieters, ohne Plattform-Aufschlag. Gecachte Input-Tokens werden mit $0.15/M abgerechnet.

Unterstützt Gemini 3.6 Flash Prompt-Caching?

Ja, automatisches Caching ist standardmäßig aktiv, dazu ein expliziter Modus für garantierte Einsparungen. Gecachte Input-Tokens werden mit $0.15/M statt $1.5/M (ungecacht) abgerechnet; Prompts brauchen ein stabiles Präfix von 1,024 Tokens, um gecacht zu werden. Prompt-Caching-Guide →

Wie erhalte ich Zugang zu Gemini 3.6 Flash?

Richten Sie Ihr vorhandenes OpenAI SDK auf base_url="https://synthorai.io/v1", setzen Sie model="gemini-3.6-flash", fertig. Ein API-Key deckt jedes Modell auf dem Gateway ab.

Verwandte Modelle

Kostenlosen API-Key holen Ihre Kosten vergleichen →