신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

GPT-5.4 Mini

2026-03-16 출시

chat비전코드도구 호출리즈닝프롬프트 캐싱

GPT-5.4 Mini는 OpenAI의 “코딩, 컴퓨터 사용, 서브에이전트를 위한 역대 가장 강력한 미니 모델”로, GPT-5.4의 강점을 더 빠르고 효율적인 티어로 가져옵니다.

입력
텍스트 이미지 $0.75/M
출력
텍스트 $4.5/M
캐시 읽기
$0.375/M
컨텍스트
400K
GPT-4o 대비
약 85% 저렴
지식 컷오프
2025-08

벤치마크

평균 상회2 / 10
GPT-5.4 Mini 측정된 다른 모델 측정 대상 평균 더 높은 점수를 낸 모델 없음
SWE-Bench Pro
54.4%
OSWorld-Verified
72.1%
GDPval-AA v2 Elo · 642-1861
1171
GPQA Diamond
88%
CharXiv (RQ) no tools
80.3%

벤더 공개: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

가격의 위치

동종 60개 모델 중 가격 위치

입력$0.75/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
출력$4.5/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
캐시 읽기$0.375/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양) 400,000
최대 출력(벤더 스펙) 128,000
지식 컷오프 2025-08

프롬프트 캐싱

캐싱 방식 자동
최소 프리픽스 1,024
수명 5-10분, 최대 1시간

사고

공급사 파라미터 reasoning.effort
허용 값 none · low · medium · high · xhigh
기본값 none 요청에서 지정하지 않을 때 적용
비활성화 가능 지원
파라미터 reasoning_effort
minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다

모델

모달리티 텍스트 + 이미지 → 텍스트
  • 코딩, 컴퓨터 사용, 서브에이전트에 가장 강한 mini 모델로 포지셔닝됨
  • 400k 컨텍스트 / 128k 최대 출력

출처: OpenAI 공식 문서 ↗

30초 만에 GPT-5.4 Mini 사용하기

OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

GPT-5.4 Mini 소개

  • 400K 토큰 컨텍스트 윈도우, 128K 최대 출력 토큰, 이미지 입력을 제공하고 스트리밍, 함수 호출, 구조화 출력을 완전히 지원하며 가격은 플래그십의 일부에 불과합니다.
  • OpenAI 릴리스 노트는 이를 대용량 워크로드를 위해 GPT-5.4급 능력을 더 빠르고 효율적인 모델로 가져온 것으로 설명하고, 튜닝 대상 워크로드로 코딩, 컴퓨터 사용, 서브에이전트 오케스트레이션을 지목합니다.
  • 에이전트를 만드는 입장에서 결정적인 점은 플래그십의 전체 도구 목록(함수 호출, 웹 검색, 파일 검색, 도구 검색, 이미지 생성, 코드 인터프리터, 호스티드 셸, apply patch, 스킬, 컴퓨터 사용, MCP)을 그대로 유지한다는 것이며, 이것이 더 저렴한 nano 티어와 갈리는 지점입니다.
  • 추론 강도는 none, low, medium, high, xhigh에 걸치고 기본값은 none이며, 긴 세션을 위한 컴팩션이 지원됩니다.
  • 400K 윈도우 안에서 문서화된 입력 상한은 272K 토큰이고 지식 컷오프는 2025년 8월입니다.
  • 업스트림에서는 Chat Completions, Responses, Batch가 모두 제공되고 프롬프트 캐싱과 할인된 캐시 입력 요율도 함께 제공되며, 출시 스냅샷은 2026년 3월자입니다.
  • 윈도우가 400K에서 멈추기 때문에 1M급 모델의 가격을 재조정하는 롱 컨텍스트 과금 임계값을 결코 넘지 않으며, 프롬프트가 길어져도 비용은 선형으로 유지됩니다.
  • Synthorai에서 GPT-5.4 Mini 요청은 다른 GPT 모델과 동일한 OpenAI 호환 엔드포인트를 지나갑니다.

자주 묻는 질문

GPT-5.4 Mini API는 무료로 사용해 볼 수 있나요?

네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $0.75/M 기준으로, 이 크레딧만으로도 GPT-5.4 Mini에 약 8K 토큰 규모의 요청을 대략 166회 보낼 수 있습니다.

GPT-5.4 Mini는 무엇에 가장 강한가요?

코딩·서브에이전트용 최강 미니, 플래그십의 일부에 불과한 가격, 128K 출력의 400K 컨텍스트. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

GPT-5.4 Mini의 가격은 얼마인가요?

Synthorai에서 GPT-5.4 Mini는 입력 토큰 100만 개당 $0.75, 출력 토큰 100만 개당 $4.5입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.375/M로 과금됩니다.

GPT-5.4 Mini는 프롬프트 캐싱을 지원하나요?

네, 자동으로 지원합니다. OpenAI에서 서빙되는 프롬프트는 코드 변경 없이 캐시됩니다. 캐시된 입력 토큰은 $0.375/M로 과금됩니다(미캐시 시 $0.75/M); 캐시되려면 프롬프트에 1,024 토큰 이상의 안정적인 프리픽스가 필요합니다 (TTL 5-10분, 최대 1시간). 프롬프트 캐싱 가이드 →

GPT-5.4 Mini는 어떻게 이용하나요?

기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="gpt-5.4-mini"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.

GPT-5.4 Mini의 지식 컷오프는 언제인가요?

벤더 공식 문서에 따르면 GPT-5.4 Mini의 지식 컷오프는 2025-08입니다(2026-07-09 기준).

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →