GPT-5.4 Pro es el nivel de razonamiento premium de la familia GPT-5.4: según OpenAI, «usa más cómputo para pensar más a fondo y ofrecer respuestas consistentemente mejores», produciendo respuestas más inteligentes y precisas en problemas difíciles.
- Entrada
- texto imagen $30/M
- Salida
- texto $180/M
- Lectura de caché
- $15/M
- Contexto
- 922K
- Corte de conocimiento
- 2025-08
Benchmarks
Publicado por los proveedores: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
El precio en contexto
Posición del precio entre 60 modelos comparables
La barra muestra dónde queda el precio de este modelo entre todos los modelos del mismo tipo en Synthorai. En cada extremo se nombra el más barato y el más caro. Son tarifas base; los descuentos por lote, región y escritura en caché están en la página de precios.
Especificaciones y límites
Tokens
| Ventana de contexto (especificación del proveedor) | 1.050.000 |
|---|---|
| Salida máxima (especificación del proveedor) | 128.000 |
| Corte de conocimiento | 2025-08 |
Caché de prompts
| Modo | automático |
|---|---|
| Prefijo mín. | 1024 |
| Duración | 5-10 min, hasta 1 hora |
Razonamiento
| Parámetro del proveedor | reasoning.effort |
|---|---|
| Valores admitidos | medium · high · xhigh |
| Valor por defecto | medium se aplica si la solicitud no indica nada |
| Se puede desactivar | No |
| Comportamiento del razonamiento | Solo por la Responses API; las solicitudes pueden tardar varios minutos, así que OpenAI recomienda el modo en segundo plano. |
| Parámetro | reasoning_effort |
| Valores | minimal · low · medium · high la superficie de parámetros del gateway - aplica el mapeo del proveedor de arriba |
Modelo
| Modalidades | texto + imagen → texto |
|---|
- Nivel pro de mayor cómputo
- no admite salidas estructuradas
- el uso multiturno es solo por la Responses API
- las solicitudes pueden tardar minutos (se recomienda el modo en segundo plano)
- contexto de 1.05M
Use GPT-5.4 Pro en 30 segundos
Compatible con OpenAI: cambie el base_url y conserve su SDK. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-pro",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-pro",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-pro",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-pro",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-pro")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Acerca de GPT-5.4 Pro
- Conserva la ventana de contexto de 1.050.000 tokens (especificación del proveedor) y los 128K de salida máxima, acepta entrada de imagen y admite esfuerzo de razonamiento en medium, high y xhigh; las solicitudes de larga duración pueden tardar varios minutos, por lo que se recomienda la ejecución en segundo plano.
- La ausencia de none y de low es el sentido del nivel: su mínimo es la deliberación, no la velocidad.
- OpenAI lo restringe a la Responses API, explicando que es lo que permite interacciones del modelo en varios turnos antes de que se responda a una solicitud, y la Batch API no se admite explícitamente en este modelo.
- Su lista de herramientas cubre llamada a funciones, búsqueda web, búsqueda de archivos, búsqueda de herramientas, generación de imágenes, apply patch, uso del ordenador y MCP.
- Se aplica la misma regla de facturación de contexto largo que en GPT-5.4: los prompts por encima de 272K tokens de entrada se cobran a 2x la entrada y 1,5x la salida para toda la solicitud.
- La fecha de corte de conocimiento es agosto de 2025 y la instantánea publicada está fechada en marzo de 2026.
- Resérvelo para problemas donde una respuesta mejor compense minutos de latencia y varias veces el coste por token.
- Synthorai hace que GPT-5.4 Pro se pueda invocar a través de su interfaz compatible con OpenAI, justo al lado de los modelos estándar.
Preguntas frecuentes
¿Se puede probar gratis la API de GPT-5.4 Pro?
Sí: las cuentas nuevas reciben 10 llamadas de prueba y hasta $1 de crédito gratuito, sin tarjeta. A $30/M por tokens de entrada, solo ese crédito cubre aproximadamente 4 solicitudes de ~8K tokens contra GPT-5.4 Pro.
¿En qué destaca GPT-5.4 Pro?
Usa más cómputo para pensar más a fondo; respuestas consistentemente mejores en problemas difíciles; ejecución en segundo plano para solicitudes de varios minutos. Consulte la sección Acerca de para el panorama completo según las notas de lanzamiento del propio proveedor.
¿Cuánto cuesta GPT-5.4 Pro?
GPT-5.4 Pro cuesta $30 por millón de tokens de entrada y $180 por millón de tokens de salida en Synthorai: el precio de lista del proveedor, sin margen de plataforma. Los tokens de entrada en caché se facturan a $15/M.
¿GPT-5.4 Pro admite caché de prompts?
Sí, automáticamente: los prompts servidos por OpenAI se almacenan en caché sin cambios de código. Los tokens de entrada en caché se facturan a $15/M frente a $30/M sin caché; los prompts necesitan un prefijo estable de 1,024 tokens para entrar en caché (TTL 5-10 min, hasta 1 hora). Guía de caché de prompts →
¿Cómo obtengo acceso a GPT-5.4 Pro?
Apunte su SDK de OpenAI existente a base_url="https://synthorai.io/v1", configure model="gpt-5.4-pro" y listo. Una sola clave API cubre todos los modelos del gateway.
¿Cuál es la fecha de corte de conocimiento de GPT-5.4 Pro?
La fecha de corte de conocimiento de GPT-5.4 Pro es 2025-08, según la documentación oficial del proveedor (a fecha de 2026-07-09).
Modelos relacionados
Comparar
Cada valor de esta página está transcrito de la documentación del proveedor, enlazada arriba, y lleva la fecha en que se comprobó. Los precios se comparan en todo el catálogo; los valores de especificación que los proveedores definen de forma distinta se muestran indicando la diferencia en lugar de representarse en un gráfico. Nada aquí lo medimos nosotros, y nada se puntúa.