Nuevo Regístrate gratis, 10 llamadas de regalo. Hasta 1 $, sin tarjeta.

GPT-5.4 Mini

Lanzamiento: 2026-03-16

chatVisiónCódigoLlamada a herramientasRazonamientoCaché de prompts

GPT-5.4 Mini es el «modelo mini más potente hasta ahora para codificación, uso del ordenador y subagentes» de OpenAI, que lleva las fortalezas de GPT-5.4 a un nivel más rápido y eficiente.

Entrada
texto imagen $0.75/M
Salida
texto $4.5/M
Lectura de caché
$0.375/M
Contexto
400K
vs GPT-4o
~85% más barato
Corte de conocimiento
2025-08

Benchmarks

Sobre la media2 / 10
GPT-5.4 Mini otros modelos medidos media de los modelos comparados ningún otro modelo puntuó más alto
SWE-Bench Pro
54.4%
OSWorld-Verified
72.1%
GDPval-AA v2 Elo · 642-1861
1171
GPQA Diamond
88%
CharXiv (RQ) no tools
80.3%

Publicado por los proveedores: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

El precio en contexto

Posición del precio entre 60 modelos comparables

Entrada$0.75/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
Salida$4.5/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
Lectura en caché$0.375/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.

Especificaciones y límites

Tokens

Ventana de contexto (especificación del proveedor) 400.000
Salida máxima (especificación del proveedor) 128.000
Corte de conocimiento 2025-08

Caché de prompts

Modo automático
Prefijo mín. 1024
Duración 5-10 min, hasta 1 hora

Razonamiento

Parámetro del proveedor reasoning.effort
Valores admitidos none · low · medium · high · xhigh
Valor por defecto none se aplica si la solicitud no indica nada
Se puede desactivar
Parámetro reasoning_effort
Valores minimal · low · medium · high la superficie de parámetros del gateway - aplica el mapeo del proveedor de arriba

Modelo

Modalidades texto + imagen → texto
  • Posicionado como el modelo mini más potente para programación, uso del ordenador y subagentes
  • contexto de 400k / salida máxima de 128k

según documentación oficial de OpenAI ↗

Use GPT-5.4 Mini en 30 segundos

Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Acerca de GPT-5.4 Mini

  • Ofrece una ventana de contexto de 400K tokens, 128K tokens de salida máxima, entrada de imagen y soporte completo de streaming, llamada a funciones y salidas estructuradas, a una fracción del precio del buque insignia.
  • La nota de lanzamiento de OpenAI lo plantea como la vía para llevar capacidades de clase GPT-5.4 a un modelo más rápido y eficiente para cargas de trabajo de alto volumen, y nombra la codificación, el uso del ordenador y la orquestación de subagentes como las cargas para las que se ajustó.
  • De forma crucial para quienes construyen agentes, conserva la lista completa de herramientas del buque insignia (llamada a funciones, búsqueda web, búsqueda de archivos, búsqueda de herramientas, generación de imágenes, intérprete de código, shell alojado, apply patch, skills, uso del ordenador y MCP), que es la línea que lo separa del nivel nano, más barato.
  • El esfuerzo de razonamiento abarca none, low, medium, high y xhigh, con none por defecto, y se admite la compactación para sesiones largas.
  • El límite de entrada documentado dentro de la ventana de 400K es de 272K tokens, y la fecha de corte de conocimiento es agosto de 2025.
  • En origen están disponibles Chat Completions, Responses y Batch, junto con la caché de prompts y su tarifa reducida de entrada en caché, y la instantánea publicada está fechada en marzo de 2026.
  • Como su ventana se detiene en 400K, nunca cruza el umbral de facturación de contexto largo que reprecia a los modelos de clase 1M, así que el coste se mantiene lineal a medida que crecen los prompts.
  • Las solicitudes a GPT-5.4 Mini en Synthorai pasan por el mismo endpoint compatible con OpenAI que cualquier modelo GPT.

Preguntas frecuentes

¿Se puede probar gratis la API de GPT-5.4 Mini?

Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $0.75/M por tokens de entrada, solo ese crédito cubre aproximadamente 166 solicitudes de ~8K tokens contra GPT-5.4 Mini.

¿En qué destaca GPT-5.4 Mini?

El mini más potente para codificación y subagentes; una fracción del precio del buque insignia; 400K de contexto con 128K de salida. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.

¿Cuánto cuesta GPT-5.4 Mini?

GPT-5.4 Mini cuesta $0.75 por millón de tokens de entrada y $4.5 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $0.375/M.

¿GPT-5.4 Mini admite caché de prompts?

Sí, automáticamente: los prompts servidos por OpenAI se almacenan en caché sin cambios de código. Los tokens de entrada en caché se facturan a $0.375/M frente a $0.75/M sin caché; los prompts necesitan un prefijo estable de 1,024 tokens para entrar en caché (TTL 5-10 min, hasta 1 hora). Guía de caché de prompts →

¿Cómo obtengo acceso a GPT-5.4 Mini?

Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gpt-5.4-mini" y listo. Una sola clave API cubre todos los modelos del gateway.

¿Cuál es la fecha de corte de conocimiento de GPT-5.4 Mini?

La fecha de corte de conocimiento de GPT-5.4 Mini es 2025-08, según la documentación oficial del proveedor (a fecha de 2026-07-09).

Modelos relacionados

Comparar

Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.

Obtén tu clave API Compare su costo →