🎁 Nouveau Inscription gratuite, 10 appels offerts. Jusqu'à 1 $, sans carte.

Gemini 3.6 Flash

Google chat vision code tools
Entrée$1.5/M
Sortie$7.5/M
Entrée audio$5/M
Lecture de cache$0.15/M
Contexte1M
vs GPT-4o~70% moins cher

Prix catalogue du fournisseur : sans majoration de plateforme, paiement à l'usage. Ce sont les prix catalogue officiels. Les clients connectés peuvent voir les prix effectifs incluant les remises de l’espace de travail sur /console/pricing. Prix d'entrée effectif avec 70 % de hits de cache :$0.555/M. La mise en cache implicite est activée par défaut pour les modèles Gemini actuels (remise automatique sur les hits de cache), plus une API CachedContent explicite avec facturation basée sur le stockage pour des économies garanties.

Utilisez Gemini 3.6 Flash en 30 secondes

Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.6-flash",
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

À propos de Gemini 3.6 Flash

Intelligence de frontière plus rapide et moins chère
Usage de tokens inférieur à 3.5 Flash selon Google
Contexte 1 M, Computer Use intégré

Gemini 3.6 Flash est un modèle en disponibilité générale (GA) que la documentation de Google positionne comme une intelligence de niveau frontière soutenue pour l'ère agentique, optimisée pour plus de vitesse et un coût moindre — la doc indique de meilleures performances sur les tâches agentiques et multimodales complexes tout en réduisant l'usage de tokens, à un prix inférieur à 3.5 Flash.

  • Il prend en charge la réflexion et la suite d'outils intégrés dont Computer Use, accepte texte, image, vidéo et audio, avec un contexte de 1 M de tokens et jusqu'à 65 536 tokens de sortie ; la page du modèle signale que temperature, top_p et top_k sont dépréciés et ignorés à partir de cette génération.
  • Synthorai le sert via son endpoint de chat compatible OpenAI.

Spécifications et limites

Sortie max (spéc. fournisseur)65,536
Modalitéstext + image + video + audio → text
Fonctionnalitéstools · structured_output · streaming · vision · batch · caching · reasoning · computer_use
À noterGA; 1M-token context, 64K max output; thinking plus the full built-in tool suite including Computer Use; officially positioned as stronger on complex agentic and multimodal tasks with lower token usage than 3.5 Flash. Note: temperature/top_p/top_k are deprecated and ignored from this generation.
Mise en cache des promptsautomatique + explicite · préfixe min. de 1,024 tokens

selon docs officielles Google ↗

FAQ

Peut-on essayer l'API Gemini 3.6 Flash gratuitement ?

Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $1.5/M de tokens en entrée, ce crédit couvre à lui seul environ 83 requêtes de ~8K tokens sur Gemini 3.6 Flash.

Quels sont les points forts de Gemini 3.6 Flash ?

Intelligence de frontière plus rapide et moins chère, ainsi que usage de tokens inférieur à 3.5 Flash selon Google et contexte 1 M, Computer Use intégré. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.

Combien coûte Gemini 3.6 Flash ?

Sur Synthorai, Gemini 3.6 Flash coûte $1.5 par million de tokens en entrée et $7.5 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.15/M.

Gemini 3.6 Flash prend-il en charge la mise en cache des prompts ?

Oui : la mise en cache automatique est activée par défaut, avec un mode explicite pour des économies garanties. Les tokens d'entrée en cache sont facturés $0.15/M contre $1.5/M hors cache ; les prompts doivent avoir un préfixe stable de 1,024 tokens pour être mis en cache. Guide de mise en cache des prompts →

Comment obtenir l'accès à Gemini 3.6 Flash ?

Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="gemini-3.6-flash", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.

Modèles associés

Obtenez votre clé API gratuite Comparez votre coût →