Claude Sonnet 4.5는 Claude 플랫폼에서 계속 사용할 수 있는 이전 세대 Sonnet 모델입니다.
- 입력
- 텍스트 이미지 $3/M
- 출력
- 텍스트 $15/M
- 캐시 읽기
- $0.3/M
- 컨텍스트
- 200K
- GPT-4o 대비
- 약 40% 저렴
- 지식 컷오프
- 2025-01
벤치마크
벤더 공개: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
가격의 위치
동종 60개 모델 중 가격 위치
이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.
스펙 및 제한
토큰
| 컨텍스트 윈도우(공급사 사양) | 200,000 |
|---|---|
| 최대 출력(벤더 스펙) | 64,000 |
| 지식 컷오프 | 2025-01 |
| 학습 데이터 기준 | 2025-07 지식 컷오프 2025-01 |
프롬프트 캐싱
| 캐싱 방식 | 명시적(옵트인) |
|---|---|
| 최소 프리픽스 | 1,024 |
| 수명 | 기본 5분, 1시간 옵션 |
| 쓰기 비용 | 1.25x (5m) / 2x (1h) |
사고
| 공급사 파라미터 | thinking.type "enabled" + budget_tokens |
|---|---|
| 허용 값 | budget_tokens at least 1,024 and below max_tokens; "adaptive" returns 400 |
| 기본값 | off, 요청에서 설정하지 않으면 사고 없음 요청에서 지정하지 않을 때 적용 |
| 비활성화 가능 | 지원 |
| 사고 동작 | 확장 사고만 지원하며 effort 파라미터는 없습니다. 이전 턴의 사고 블록은 제거되고 마지막 것만 남습니다. 인터리브드 사고에는 interleaved-thinking-2025-05-14 베타 헤더가 필요합니다. |
| 파라미터 | reasoning_effort |
| 값 | minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다 |
모델
| 모달리티 | 텍스트 + 이미지 → 텍스트 |
|---|
- 레거시 모델
- 1M 컨텍스트 베타(context-1m-2025-08-07)는 2026-04-30에 종료되어 현재는 200k 컨텍스트 / 64k 최대 출력으로 제한
30초 만에 Claude Sonnet 4.5 사용하기
OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="claude-sonnet-4-5",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "claude-sonnet-4-5",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "claude-sonnet-4-5",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "claude-sonnet-4-5",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("claude-sonnet-4-5")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Claude Sonnet 4.5 소개
- 상대적으로 빠른 지연 시간과 강력한 추론을 결합해 200K 토큰 컨텍스트 윈도우, 최대 64K 출력 토큰, 확장 사고, 비전 입력, Claude의 전체 도구 사용 스택을 100만 토큰당 $3/$15에 지원합니다.
- Anthropic은 이를 복잡한 에이전트와 코딩을 위한 최고의 모델로, 당시 대부분의 과제에서 가장 높은 지능을 갖춘 모델로 소개했고, 구조화 출력이 퍼블릭 베타로 처음 출시된 뒤 정식 제공으로 넘어간 릴리스이기도 합니다.
- 워크로드 규모를 잡기 전에 알아둘 제약이 하나 있습니다.
- 1M 토큰 컨텍스트 베타는 2026년 4월에 종료되었고, 표준 200K 윈도우를 넘는 요청은 이제 조용히 잘리는 대신 오류를 반환합니다.
- 사고는 명시적 토큰 예산을 쓰는 구식 확장 사고 방식이고, 적응형 사고 타입은 오류를 반환하며, 추론 강도(effort) 파라미터는 없습니다.
- 인터리브드 사고에는 베타 헤더가 필요하고, 이전 턴의 사고 블록은 이어지지 않고 제거됩니다.
- 프롬프트 캐싱은 1,024 토큰 프리픽스부터 시작합니다.
- Anthropic은 이제 성능 향상을 위해 더 새로운 Sonnet 릴리스를 권장하지만, Sonnet 4.5는 이 모델에 맞춰 튜닝된 워크로드를 위한 안정적인 고정 스냅샷으로 남아 있습니다.
- Synthorai는 카탈로그의 나머지와 동일한 OpenAI 호환 API 뒤에서 이 모델을 계속 서빙합니다.
자주 묻는 질문
Claude Sonnet 4.5 API는 무료로 사용해 볼 수 있나요?
네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $3/M 기준으로, 이 크레딧만으로도 Claude Sonnet 4.5에 약 8K 토큰 규모의 요청을 대략 41회 보낼 수 있습니다.
Claude Sonnet 4.5는 무엇에 가장 강한가요?
빠른 지연 시간과 강력한 추론의 결합, 200K 컨텍스트에 100만당 $3/$15, 튜닝된 워크로드용 안정 고정 스냅샷. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.
Claude Sonnet 4.5의 가격은 얼마인가요?
Synthorai에서 Claude Sonnet 4.5는 입력 토큰 100만 개당 $3, 출력 토큰 100만 개당 $15입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.3/M로 과금됩니다.
Claude Sonnet 4.5는 프롬프트 캐싱을 지원하나요?
네, 옵트인 방식으로 안정적인 프리픽스를 cache_control 브레이크포인트로 표시합니다. 캐시된 입력 토큰은 $0.3/M로 과금됩니다(미캐시 시 $3/M); 캐시되려면 프롬프트에 1,024 토큰 이상의 안정적인 프리픽스가 필요합니다 (TTL 기본 5분, 1시간 옵션). 프롬프트 캐싱 가이드 →
Claude Sonnet 4.5는 어떻게 이용하나요?
기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="claude-sonnet-4-5"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.
Claude Sonnet 4.5의 지식 컷오프는 언제인가요?
벤더 공식 문서에 따르면 Claude Sonnet 4.5의 지식 컷오프는 2025-01입니다(2026-07-09 기준).
관련 모델
비교
이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.