Gemini 3.7 Flash è il modello Flash più capace di Google, disponibile dal 13 agosto 2026 e pensato per flussi agentici e ragionamento multimodale.
- Input
- testo immagine audio video $0.75/M
- Output
- testo $3.75/M
- Input audio
- $0.75/M
- Lettura cache
- $0.075/M
- Contesto
- 1M
- vs GPT-4o
- ~85% più economico
Prezzi di listino del provider: senza ricarico della piattaforma, pagamento a consumo. Questi sono i prezzi di listino ufficiali. I clienti autenticati possono vedere i prezzi effettivi, inclusi gli sconti workspace, su /console/pricing. Input effettivo con un tasso di cache hit del 70%:$0.2775/M. Il caching implicito è attivo di default per i modelli Gemini attuali (scontato automaticamente sugli hit della cache), più un'API CachedContent esplicita con fatturazione basata sullo storage per risparmi garantiti. Questa tariffa di lettura da cache è solo una parte del conto: questo fornitore addebita separatamente anche la conservazione della cache.
Prezzo · posizione tra 55 modelli comparabili
La barra mostra dove si colloca il prezzo di questo modello tra tutti i modelli dello stesso tipo su Synthorai. Alle due estremità sono indicati il più economico e il più caro. Sono tariffe base; gli sconti per batch, regione e scrittura in cache sono nella pagina dei prezzi.
Specifiche e limiti
Token
| Finestra di contesto (specifica del fornitore) | 1.048.576 |
|---|---|
| Output massimo (specifica del vendor) | 65.536 |
Caching prompt
| Modalità | automatico + esplicito |
|---|---|
| Prefisso min. | 1.024 |
Ragionamento
| Parametro | reasoning_effort |
|---|---|
| Valori | minimal · low · medium · high l'insieme accettato è del provider |
Modello
| Modalità | testo + immagine + audio + video → testo |
|---|
- Google's most capable Flash model for agentic workflows and multimodal reasoning
- output price includes thinking tokens, and audio and video input bill at the text rate
Usa Gemini 3.7 Flash in 30 secondi
Compatibile OpenAI: cambia la base_url, tieni il tuo SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3.7-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3.7-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3.7-flash")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Informazioni su Gemini 3.7 Flash
- Accetta testo, immagini, audio e video e restituisce testo, così una singola chiamata può ragionare insieme su uno screenshot, una registrazione e un prompt, senza concatenare più modelli.
- Due dettagli di prezzo rendono il preventivo particolarmente semplice.
- Primo, **non c'è alcuno scalino legato alla lunghezza del contesto**: un prompt da 900.000 token costa per token quanto uno da 900, quindi il lavoro su contesti lunghi non rincara a metà strada.
- Secondo, **non c'è nemmeno un sovrapprezzo per modalità**: audio e video in ingresso sono fatturati alla tariffa del testo, il contrario di quasi tutti i listini multimodali, il che elimina la solita ragione per ridurre la qualità dei media prima dell'invio.
- Il prezzo di output **include i token di pensiero**, perciò una risposta con molto ragionamento viene fatturata sull'intera traccia e non solo sul testo visibile; tenetene conto nel limite di output.
- La cache di contesto costa circa un decimo della tariffa di input, più un addebito orario di archiviazione, quindi fissare un prefisso stabile conviene nei cicli agentici.
- Il grounding con la Ricerca Google include una quota mensile condivisa dalla famiglia Gemini 3.
- Synthorai lo offre tramite l'endpoint chat completions compatibile con OpenAI.
FAQ
L'API di Gemini 3.7 Flash si può provare gratis?
Sì: i nuovi account ricevono 10 chiamate di prova e fino a $1 di credito gratuito, senza carta richiesta. A $0.75/M token in input, quel credito da solo copre circa 166 richieste da ~8K token verso Gemini 3.7 Flash.
In cosa eccelle Gemini 3.7 Flash?
Livello Flash più capace per il lavoro agentico; input testo, immagini, audio e video; nessuno scalino di contesto né sovrapprezzo di modalità. Il quadro completo è nella sezione «Informazioni», tratto dalle note di rilascio ufficiali del vendor.
Quanto costa Gemini 3.7 Flash?
Su Synthorai, Gemini 3.7 Flash costa $0.75 per milione di token in input e $3.75 per milione di token in output: il prezzo di listino del provider, senza ricarico della piattaforma. I token di input in cache si fatturano a $0.075/M.
Gemini 3.7 Flash supporta il caching dei prompt?
Sì: il caching automatico è attivo di default, con una modalità esplicita per risparmi garantiti. I token di input in cache si fatturano a $0.075/M contro $0.75/M senza cache; per andare in cache i prompt richiedono un prefisso stabile di 1,024 token. Guida al caching dei prompt →
Come ottengo l'accesso a Gemini 3.7 Flash?
Punta il tuo SDK OpenAI esistente a base_url="https://synthorai.io/v1", imposta model="gemini-3.7-flash" e hai finito: una sola chiave API copre tutti i modelli del gateway.
Modelli correlati
Ogni valore di questa pagina è trascritto dalla documentazione del fornitore, collegata sopra, e riporta la data in cui è stato verificato. I prezzi sono confrontati sull'intero catalogo; i valori di specifica che i fornitori definiscono in modo diverso sono mostrati indicando la differenza anziché messi a grafico. Nulla qui è misurato da noi e nulla è valutato con un punteggio.