Gemini 3.5 Flash-Lite
Prix catalogue du fournisseur : sans majoration de plateforme, paiement à l'usage. Ce sont les prix catalogue officiels. Les clients connectés peuvent voir les prix effectifs incluant les remises de l’espace de travail sur /console/pricing. Prix d'entrée effectif avec 70 % de hits de cache :$0.111/M. La mise en cache implicite est activée par défaut pour les modèles Gemini actuels (remise automatique sur les hits de cache), plus une API CachedContent explicite avec facturation basée sur le stockage pour des économies garanties.
Utilisez Gemini 3.5 Flash-Lite en 30 secondes
Compatible OpenAI : changez la base_url, gardez votre SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3.5-flash-lite",
messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3.5-flash-lite",
messages: [{ role: "user", content: "Summarize this diff" }],
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash-lite",
"messages": [{"role": "user", "content": "Hello"}]
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3.5-flash-lite",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3.5-flash-lite")
.addUserMessage("Summarize this diff")
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));À propos de Gemini 3.5 Flash-Lite
Gemini 3.5 Flash-Lite est un modèle multimodal à faible latence en disponibilité générale (GA) que la documentation de Google décrit comme le modèle le plus rapide et le moins cher de la famille 3.5, optimisé pour une exécution à haut débit et faible coût (tâches de sous-agents, analyse de documents).
- Il prend en charge la réflexion et les outils intégrés dont Computer Use, accepte texte, image, vidéo et audio, avec un contexte de 1 M de tokens et jusqu'à 65 536 tokens de sortie ; la page du modèle indique que temperature, top_p et top_k sont dépréciés et ignorés à partir de cette génération.
- Synthorai le sert via son endpoint de chat compatible OpenAI.
Spécifications et limites
| Sortie max (spéc. fournisseur) | 65,536 |
| Modalités | text + image + video + audio → text |
| Fonctionnalités | tools · structured_output · streaming · vision · batch · caching · reasoning · computer_use |
| À noter | GA; 1M-token context, 64K max output; the fastest, lowest-cost model in the 3.5 family, optimized for high-throughput low-cost execution (subagent tasks, document parsing); thinking and built-in tools incl. Computer Use. Note: temperature/top_p/top_k are deprecated and ignored from this generation. |
| Mise en cache des prompts | automatique + explicite · préfixe min. de 1,024 tokens |
FAQ
Peut-on essayer l'API Gemini 3.5 Flash-Lite gratuitement ?
Oui : les nouveaux comptes reçoivent 10 appels d'essai et jusqu'à $1 de crédit gratuit, sans carte bancaire. À $0.3/M de tokens en entrée, ce crédit couvre à lui seul environ 416 requêtes de ~8K tokens sur Gemini 3.5 Flash-Lite.
Quels sont les points forts de Gemini 3.5 Flash-Lite ?
Le plus rapide et le moins cher de la famille 3.5, ainsi que conçu pour sous-agents et analyse à haut débit et contexte 1 M, réflexion et outils intégrés. Voir la section À propos pour le tableau complet, tiré des notes de version officielles du fournisseur.
Combien coûte Gemini 3.5 Flash-Lite ?
Sur Synthorai, Gemini 3.5 Flash-Lite coûte $0.3 par million de tokens en entrée et $2.5 par million de tokens en sortie, soit le prix catalogue du fournisseur, sans majoration de plateforme. Les tokens d'entrée en cache sont facturés $0.03/M.
Gemini 3.5 Flash-Lite prend-il en charge la mise en cache des prompts ?
Oui : la mise en cache automatique est activée par défaut, avec un mode explicite pour des économies garanties. Les tokens d'entrée en cache sont facturés $0.03/M contre $0.3/M hors cache ; les prompts doivent avoir un préfixe stable de 1,024 tokens pour être mis en cache. Guide de mise en cache des prompts →
Comment obtenir l'accès à Gemini 3.5 Flash-Lite ?
Pointez votre SDK OpenAI existant vers base_url="https://synthorai.io/v1", définissez model="gemini-3.5-flash-lite", et c'est tout. Une seule clé API couvre tous les modèles de la passerelle.