GPT-5.4 Mini는 OpenAI의 “코딩, 컴퓨터 사용, 서브에이전트를 위한 역대 가장 강력한 미니 모델”로, GPT-5.4의 강점을 더 빠르고 효율적인 티어로 가져옵니다.
- 입력
- 텍스트 이미지 $0.75/M
- 출력
- 텍스트 $4.5/M
- 캐시 읽기
- $0.375/M
- 컨텍스트
- 400K
- GPT-4o 대비
- 약 85% 저렴
- 지식 컷오프
- 2025-08
벤치마크
벤더 공개: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai
가격의 위치
동종 60개 모델 중 가격 위치
이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.
스펙 및 제한
토큰
| 컨텍스트 윈도우(공급사 사양) | 400,000 |
|---|---|
| 최대 출력(벤더 스펙) | 128,000 |
| 지식 컷오프 | 2025-08 |
프롬프트 캐싱
| 캐싱 방식 | 자동 |
|---|---|
| 최소 프리픽스 | 1,024 |
| 수명 | 5-10분, 최대 1시간 |
사고
| 공급사 파라미터 | reasoning.effort |
|---|---|
| 허용 값 | none · low · medium · high · xhigh |
| 기본값 | none 요청에서 지정하지 않을 때 적용 |
| 비활성화 가능 | 지원 |
| 파라미터 | reasoning_effort |
| 값 | minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다 |
모델
| 모달리티 | 텍스트 + 이미지 → 텍스트 |
|---|
- 코딩, 컴퓨터 사용, 서브에이전트에 가장 강한 mini 모델로 포지셔닝됨
- 400k 컨텍스트 / 128k 최대 출력
출처: OpenAI 공식 문서 ↗
30초 만에 GPT-5.4 Mini 사용하기
OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gpt-5.4-mini",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gpt-5.4-mini",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.4-mini",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gpt-5.4-mini",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gpt-5.4-mini")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));GPT-5.4 Mini 소개
- 400K 토큰 컨텍스트 윈도우, 128K 최대 출력 토큰, 이미지 입력을 제공하고 스트리밍, 함수 호출, 구조화 출력을 완전히 지원하며 가격은 플래그십의 일부에 불과합니다.
- OpenAI 릴리스 노트는 이를 대용량 워크로드를 위해 GPT-5.4급 능력을 더 빠르고 효율적인 모델로 가져온 것으로 설명하고, 튜닝 대상 워크로드로 코딩, 컴퓨터 사용, 서브에이전트 오케스트레이션을 지목합니다.
- 에이전트를 만드는 입장에서 결정적인 점은 플래그십의 전체 도구 목록(함수 호출, 웹 검색, 파일 검색, 도구 검색, 이미지 생성, 코드 인터프리터, 호스티드 셸, apply patch, 스킬, 컴퓨터 사용, MCP)을 그대로 유지한다는 것이며, 이것이 더 저렴한 nano 티어와 갈리는 지점입니다.
- 추론 강도는 none, low, medium, high, xhigh에 걸치고 기본값은 none이며, 긴 세션을 위한 컴팩션이 지원됩니다.
- 400K 윈도우 안에서 문서화된 입력 상한은 272K 토큰이고 지식 컷오프는 2025년 8월입니다.
- 업스트림에서는 Chat Completions, Responses, Batch가 모두 제공되고 프롬프트 캐싱과 할인된 캐시 입력 요율도 함께 제공되며, 출시 스냅샷은 2026년 3월자입니다.
- 윈도우가 400K에서 멈추기 때문에 1M급 모델의 가격을 재조정하는 롱 컨텍스트 과금 임계값을 결코 넘지 않으며, 프롬프트가 길어져도 비용은 선형으로 유지됩니다.
- Synthorai에서 GPT-5.4 Mini 요청은 다른 GPT 모델과 동일한 OpenAI 호환 엔드포인트를 지나갑니다.
자주 묻는 질문
GPT-5.4 Mini API는 무료로 사용해 볼 수 있나요?
네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $0.75/M 기준으로, 이 크레딧만으로도 GPT-5.4 Mini에 약 8K 토큰 규모의 요청을 대략 166회 보낼 수 있습니다.
GPT-5.4 Mini는 무엇에 가장 강한가요?
코딩·서브에이전트용 최강 미니, 플래그십의 일부에 불과한 가격, 128K 출력의 400K 컨텍스트. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.
GPT-5.4 Mini의 가격은 얼마인가요?
Synthorai에서 GPT-5.4 Mini는 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $4.5입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.375/M로 과금됩니다.
GPT-5.4 Mini는 프롬프트 캐싱을 지원하나요?
네, 자동으로 지원합니다. OpenAI에서 서빙되는 프롬프트는 코드 변경 없이 캐시됩니다. 캐시된 입력 토큰은 $0.375/M로 과금됩니다(미캐시 시 $0.75/M); 캐시되려면 프롬프트에 1,024 토큰 이상의 안정적인 프리픽스가 필요합니다 (TTL 5-10분, 최대 1시간). 프롬프트 캐싱 가이드 →
GPT-5.4 Mini는 어떻게 이용하나요?
기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="gpt-5.4-mini"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.
GPT-5.4 Mini의 지식 컷오프는 언제인가요?
벤더 공식 문서에 따르면 GPT-5.4 Mini의 지식 컷오프는 2025-08입니다(2026-07-09 기준).
관련 모델
비교
이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.