Gemini 3 Flash (preview) es el modelo que la documentación de Google describe como el mejor del mundo para la comprensión multimodal y su «modelo agéntico y de vibe coding más potente hasta la fecha», lanzado con la promesa de un rendimiento de clase frontera que rivaliza con modelos más grandes a una fracción del coste.
- Entrada
- texto imagen vídeo audio $0.5/M
- Salida
- texto $3/M
- Entrada de audio
- $1/M
- Lectura de caché
- $0.05/M
- Contexto
- 1M
- vs GPT-4o
- ~90% más barato
- Corte de conocimiento
- 2025-01
Benchmarks
Publicado por los proveedores: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai
El precio en contexto
Posición del precio entre 60 modelos comparables
La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.
Especificaciones y límites
Tokens
| Ventana de contexto (especificación del proveedor) | 1.048.576 |
|---|---|
| Salida máxima (especificación del proveedor) | 65.536 |
| Corte de conocimiento | 2025-01 |
Caché de prompts
| Modo | automático + explícito |
|---|---|
| Prefijo mín. | 4096 |
Razonamiento
| Parámetro del proveedor | thinkingLevel |
|---|---|
| Valores admitidos | minimal · low · medium · high |
| Valor por defecto | high se aplica si la solicitud no indica nada |
| Se puede desactivar | No |
| Comportamiento del razonamiento | Google afirma que Gemini 3 Flash no admite desactivar el pensamiento por completo, así que minimal es un mínimo y no un interruptor, y los tokens de pensamiento se facturan como tokens de salida en cada solicitud; las firmas de pensamiento deben devolverse tal cual y son obligatorias para la llamada a funciones. |
| Parámetro | reasoning_effort |
| Valores | minimal · low · medium · high la superficie de parámetros del gateway - aplica el mapeo del proveedor de arriba |
Modelo
| Modalidades | texto + imagen + vídeo + audio → texto |
|---|
- Modelo en preview
- 1.048.576 tokens de entrada
- uso del ordenador admitido
- la generación de imágenes NO está admitida pese a la etiqueta de capacidad del gateway
Use Gemini 3 Flash en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3-flash-preview",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3-flash-preview",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3-flash-preview",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3-flash-preview")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Acerca de Gemini 3 Flash
- Acepta entrada de texto, imagen, vídeo, audio y PDF dentro de una ventana de contexto de 1.048.576 tokens y produce hasta 65.536 tokens de salida.
- Las capacidades incluyen llamada a funciones, salidas estructuradas, ejecución de código, uso del ordenador, grounding de búsqueda y de Maps, contexto de URL, búsqueda de archivos, caché de contexto, la Batch API y la inferencia Flex y Priority.
- El pensamiento se controla con thinking_level, que acepta minimal, low, medium y high y toma high por defecto, el valor por defecto más caro de la familia: en todos los modelos Gemini 3, minimal es un mínimo y no un interruptor de apagado, así que los tokens de pensamiento se facturan en cada solicitud.
- La generación introdujo además las firmas de pensamiento, trazas cifradas del razonamiento interno que hay que devolver para preservar la continuidad entre varios turnos, junto con nuevos controles de resolución de medios, y ambas cosas son trabajo de migración y no extras opcionales al subir desde 2.5.
- Como canal de vista previa no ofrece garantías de estabilidad; el sucesor estable de Google es gemini-3.5-flash, cuya página de modelo lista este ID como su alias de vista previa.
- Synthorai lo ofrece a través de su interfaz unificada de chat completions compatible con OpenAI.
Preguntas frecuentes
¿Se puede probar gratis la API de Gemini 3 Flash?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $0.5/M por tokens de entrada, solo ese crédito cubre aproximadamente 250 solicitudes de ~8K tokens contra Gemini 3 Flash.
¿En qué destaca Gemini 3 Flash?
Descrito como el mejor para comprensión multimodal; razonamiento de vanguardia con fuerza en codificación creativa; soporte de uso del ordenador y grounding de Maps. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta Gemini 3 Flash?
Gemini 3 Flash cuesta $0.5 por millón de tokens de entrada y $3 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $0.05/M.
¿Gemini 3 Flash admite caché de prompts?
Sí: el caché automático viene activado por defecto, con un modo explícito para ahorros garantizados. Los tokens de entrada en caché se facturan a $0.05/M frente a $0.5/M sin caché; los prompts necesitan un prefijo estable de 4,096 tokens para entrar en caché. Guía de caché de prompts →
¿Cómo obtengo acceso a Gemini 3 Flash?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gemini-3-flash-preview" y listo. Una sola clave API cubre todos los modelos del gateway.
¿Cuál es la fecha de corte de conocimiento de Gemini 3 Flash?
La fecha de corte de conocimiento de Gemini 3 Flash es 2025-01, según la documentación oficial del proveedor (a fecha de 2026-07-09).
Modelos relacionados
Comparar
Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.