신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.

Claude Sonnet 4.5

2025-09-29 출시

chat코드리즈닝도구 호출비전프롬프트 캐싱

Claude Sonnet 4.5는 Claude 플랫폼에서 계속 사용할 수 있는 이전 세대 Sonnet 모델입니다.

입력
텍스트 이미지 $3/M
출력
텍스트 $15/M
캐시 읽기
$0.3/M
컨텍스트
200K
GPT-4o 대비
약 40% 저렴
지식 컷오프
2025-01

벤치마크

평균 상회1 / 6
Claude Sonnet 4.5 측정된 다른 모델 측정 대상 평균 더 높은 점수를 낸 모델 없음
SciCode
45%
GPQA Diamond
83%

벤더 공개: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

가격의 위치

동종 60개 모델 중 가격 위치

입력$3/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
출력$15/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
캐시 읽기$0.3/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양) 200,000
최대 출력(벤더 스펙) 64,000
지식 컷오프 2025-01
학습 데이터 기준 2025-07 지식 컷오프 2025-01

프롬프트 캐싱

캐싱 방식 명시적(옵트인)
최소 프리픽스 1,024
수명 기본 5분, 1시간 옵션
쓰기 비용 1.25x (5m) / 2x (1h)

사고

공급사 파라미터 thinking.type "enabled" + budget_tokens
허용 값 budget_tokens at least 1,024 and below max_tokens; "adaptive" returns 400
기본값 off, 요청에서 설정하지 않으면 사고 없음 요청에서 지정하지 않을 때 적용
비활성화 가능 지원
사고 동작 확장 사고만 지원하며 effort 파라미터는 없습니다. 이전 턴의 사고 블록은 제거되고 마지막 것만 남습니다. 인터리브드 사고에는 interleaved-thinking-2025-05-14 베타 헤더가 필요합니다.
파라미터 reasoning_effort
minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다

모델

모달리티 텍스트 + 이미지 → 텍스트
  • 레거시 모델
  • 1M 컨텍스트 베타(context-1m-2025-08-07)는 2026-04-30에 종료되어 현재는 200k 컨텍스트 / 64k 최대 출력으로 제한

출처: Anthropic 공식 문서 ↗

30초 만에 Claude Sonnet 4.5 사용하기

OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-sonnet-4-5",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Claude Sonnet 4.5 소개

  • 상대적으로 빠른 지연 시간과 강력한 추론을 결합해 200K 토큰 컨텍스트 윈도우, 최대 64K 출력 토큰, 확장 사고, 비전 입력, Claude의 전체 도구 사용 스택을 100만 토큰당 $3/$15에 지원합니다.
  • Anthropic은 이를 복잡한 에이전트와 코딩을 위한 최고의 모델로, 당시 대부분의 과제에서 가장 높은 지능을 갖춘 모델로 소개했고, 구조화 출력이 퍼블릭 베타로 처음 출시된 뒤 정식 제공으로 넘어간 릴리스이기도 합니다.
  • 워크로드 규모를 잡기 전에 알아둘 제약이 하나 있습니다.
  • 1M 토큰 컨텍스트 베타는 2026년 4월에 종료되었고, 표준 200K 윈도우를 넘는 요청은 이제 조용히 잘리는 대신 오류를 반환합니다.
  • 사고는 명시적 토큰 예산을 쓰는 구식 확장 사고 방식이고, 적응형 사고 타입은 오류를 반환하며, 추론 강도(effort) 파라미터는 없습니다.
  • 인터리브드 사고에는 베타 헤더가 필요하고, 이전 턴의 사고 블록은 이어지지 않고 제거됩니다.
  • 프롬프트 캐싱은 1,024 토큰 프리픽스부터 시작합니다.
  • Anthropic은 이제 성능 향상을 위해 더 새로운 Sonnet 릴리스를 권장하지만, Sonnet 4.5는 이 모델에 맞춰 튜닝된 워크로드를 위한 안정적인 고정 스냅샷으로 남아 있습니다.
  • Synthorai는 카탈로그의 나머지와 동일한 OpenAI 호환 API 뒤에서 이 모델을 계속 서빙합니다.

자주 묻는 질문

Claude Sonnet 4.5 API는 무료로 사용해 볼 수 있나요?

네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $3/M 기준으로, 이 크레딧만으로도 Claude Sonnet 4.5에 약 8K 토큰 규모의 요청을 대략 41회 보낼 수 있습니다.

Claude Sonnet 4.5는 무엇에 가장 강한가요?

빠른 지연 시간과 강력한 추론의 결합, 200K 컨텍스트에 100만당 $3/$15, 튜닝된 워크로드용 안정 고정 스냅샷. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

Claude Sonnet 4.5의 가격은 얼마인가요?

Synthorai에서 Claude Sonnet 4.5는 입력 토큰 100만 개당 $3, 출력 토큰 100만 개당 $15입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.3/M로 과금됩니다.

Claude Sonnet 4.5는 프롬프트 캐싱을 지원하나요?

네, 옵트인 방식으로 안정적인 프리픽스를 cache_control 브레이크포인트로 표시합니다. 캐시된 입력 토큰은 $0.3/M로 과금됩니다(미캐시 시 $3/M); 캐시되려면 프롬프트에 1,024 토큰 이상의 안정적인 프리픽스가 필요합니다 (TTL 기본 5분, 1시간 옵션). 프롬프트 캐싱 가이드 →

Claude Sonnet 4.5는 어떻게 이용하나요?

기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="claude-sonnet-4-5"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.

Claude Sonnet 4.5의 지식 컷오프는 언제인가요?

벤더 공식 문서에 따르면 Claude Sonnet 4.5의 지식 컷오프는 2025-01입니다(2026-07-09 기준).

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →