Gemini 3.7 Flash es el modelo Flash más capaz de Google, disponible de forma general desde el 13 de agosto de 2026 y orientado a flujos agénticos y razonamiento multimodal.
- Entrada
- texto imagen audio vídeo $0.75/M
- Salida
- texto $3.75/M
- Entrada de audio
- $0.75/M
- Lectura de caché
- $0.075/M
- Contexto
- 1M
- vs GPT-4o
- ~85% más barato
Precios de lista del proveedor, sin margen de plataforma, pago por uso. Estos son los precios de lista oficiales. Los clientes con sesión iniciada pueden ver los precios efectivos con descuentos del espacio de trabajo en /console/pricing. Precio de entrada efectivo con una tasa de aciertos de caché del 70%:$0.2775/M. La caché implícita está activada por defecto en los modelos Gemini actuales (con descuento automático en los aciertos de caché), además de una API explícita CachedContent con facturación basada en almacenamiento para un ahorro garantizado. Esa tarifa de lectura en caché es solo una parte de la factura: este proveedor también cobra aparte por mantener la caché.
Precio · posición entre 55 modelos comparables
La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.
Especificaciones y límites
Tokens
| Ventana de contexto (especificación del proveedor) | 1.048.576 |
|---|---|
| Salida máxima (especificación del proveedor) | 65.536 |
Caché de prompts
| Modo | automático + explícito |
|---|---|
| Prefijo mín. | 1024 |
Razonamiento
| Parámetro | reasoning_effort |
|---|---|
| Valores | minimal · low · medium · high el conjunto aceptado es del proveedor |
Modelo
| Modalidades | texto + imagen + audio + vídeo → texto |
|---|
- Google's most capable Flash model for agentic workflows and multimodal reasoning
- output price includes thinking tokens, and audio and video input bill at the text rate
Use Gemini 3.7 Flash en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3.7-flash",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3.7-flash",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.7-flash",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3.7-flash",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3.7-flash")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Acerca de Gemini 3.7 Flash
- Acepta texto, imágenes, audio y vídeo y devuelve texto, de modo que una sola llamada puede razonar a la vez sobre una captura, una grabación y una indicación, sin encadenar varios modelos.
- Dos detalles de precio hacen que el presupuesto sea especialmente sencillo.
- Primero, **no hay escalón por longitud de contexto**: una indicación de 900.000 tokens cuesta lo mismo por token que una de 900, así que el trabajo de contexto largo no se encarece a mitad de camino.
- Segundo, **tampoco hay recargo por modalidad**: la entrada de audio y vídeo se factura a la tarifa del texto, lo contrario de lo habitual en precios multimodales, lo que elimina el motivo típico para submuestrear los medios antes de enviarlos.
- El precio de salida **incluye los tokens de pensamiento**, de modo que una respuesta con mucho razonamiento se factura sobre la traza completa y no solo sobre el texto visible; tenlo en cuenta al fijar la salida máxima.
- La caché de contexto cuesta alrededor de una décima parte de la tarifa de entrada, más un cargo de almacenamiento por hora, así que fijar un prefijo estable compensa en bucles de agente.
- El anclaje con la Búsqueda de Google incluye un cupo mensual compartido por la familia Gemini 3.
- Synthorai lo ofrece a través del endpoint de chat completions compatible con OpenAI.
Preguntas frecuentes
¿Se puede probar gratis la API de Gemini 3.7 Flash?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $0.75/M por tokens de entrada, solo ese crédito cubre aproximadamente 166 solicitudes de ~8K tokens contra Gemini 3.7 Flash.
¿En qué destaca Gemini 3.7 Flash?
Nivel Flash más capaz para trabajo agéntico; entrada de texto, imagen, audio y vídeo; sin escalón de contexto ni recargo de modalidad. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta Gemini 3.7 Flash?
Gemini 3.7 Flash cuesta $0.75 por millón de tokens de entrada y $3.75 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $0.075/M.
¿Gemini 3.7 Flash admite caché de prompts?
Sí: el caché automático viene activado por defecto, con un modo explícito para ahorros garantizados. Los tokens de entrada en caché se facturan a $0.075/M frente a $0.75/M sin caché; los prompts necesitan un prefijo estable de 1,024 tokens para entrar en caché. Guía de caché de prompts →
¿Cómo obtengo acceso a Gemini 3.7 Flash?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gemini-3.7-flash" y listo. Una sola clave API cubre todos los modelos del gateway.
Modelos relacionados
Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.