Gemini 3.6 Flash
Prix catalogue du fournisseur : sans majoration de plateforme, paiement à l'usage. Ce sont les prix catalogue officiels. Les clients connectés peuvent voir les prix effectifs incluant les remises de l’espace de travail sur /console/pricing. Prix d'entrée effectif avec 70 % de hits de cache :$0.555/M. La mise en cache implicite est activée par défaut pour les modèles Gemini actuels (remise automatique sur les hits de cache), plus une API CachedContent explicite avec facturation basée sur le stockage pour des économies garanties.
Utilisez Gemini 3.6 Flash en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3.6-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3.6-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.6-flash",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3.6-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3.6-flash")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));À propos de Gemini 3.6 Flash
Gemini 3.6 Flash est un modèle en disponibilité générale (GA) que la documentation de Google positionne comme une intelligence de niveau frontière soutenue pour l'ère agentique, optimisée pour plus de vitesse et un coût moindre — la doc indique de meilleures performances sur les tâches agentiques et multimodales complexes tout en réduisant l'usage de tokens, à un prix inférieur à 3.5 Flash.
- Il prend en charge la réflexion et la suite d'outils intégrés dont Computer Use, accepte texte, image, vidéo et audio, avec un contexte de 1 M de tokens et jusqu'à 65 536 tokens de sortie ; la page du modèle signale que temperature, top_p et top_k sont dépréciés et ignorés à partir de cette génération.
- Synthorai le sert via son endpoint de chat compatible OpenAI.
Spécifications et limites
| Sortie max (spéc. fournisseur) | 65,536 |
| Modalités | text + image + video + audio → text |
| Fonctionnalités | tools · structured_output · streaming · vision · batch · caching · reasoning · computer_use |
| À noter | GA; 1M-token context, 64K max output; thinking plus the full built-in tool suite including Computer Use; officially positioned as stronger on complex agentic and multimodal tasks with lower token usage than 3.5 Flash. Note: temperature/top_p/top_k are deprecated and ignored from this generation. |
| Mise en cache des prompts | automatique + explicite · préfixe min. de 1,024 tokens |
FAQ
Peut-on essayer l'API Gemini 3.6 Flash gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $1.5/M de tokens en entrée, ce crédit couvre à lui seul environ 83 requêtes de ~8K tokens sur Gemini 3.6 Flash.
Quels sont les points forts de Gemini 3.6 Flash ?
Intelligence de frontière plus rapide et moins chère, ainsi que usage de tokens inférieur à 3.5 Flash selon Google et contexte 1 M, Computer Use intégré. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte Gemini 3.6 Flash ?
Sur Synthorai, Gemini 3.6 Flash coûte $1.5 par million de tokens en entrée et $7.5 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.15/M.
Gemini 3.6 Flash prend-il en charge la mise en cache des prompts ?
Oui : la mise en cache automatique est activée par défaut, avec un mode explicite pour des économies garanties. Les tokens d'entrée en cache sont facturés $0.15/M contre $1.5/M hors cache ; les prompts doivent avoir un préfixe stable de 1,024 tokens pour être mis en cache. Guide de mise en cache des prompts →
Comment obtenir l'accès à Gemini 3.6 Flash ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="gemini-3.6-flash", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.