GLM-5-Turbo는 OpenClaw 에이전트 시나리오에 맞춰 깊이 최적화된 Z.AI 파운데이션 모델입니다.
- 입력
- 텍스트 $1.2/M
- 출력
- 텍스트 $4/M
- 캐시 읽기
- $0.24/M
- 컨텍스트
- 205K
- GPT-4o 대비
- 약 76% 저렴
가격의 위치
동종 60개 모델 중 가격 위치
이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.
스펙 및 제한
토큰
| 컨텍스트 윈도우(공급사 사양) | 200,000 |
|---|---|
| 최대 출력(벤더 스펙) | 131,072 |
프롬프트 캐싱
| 캐싱 방식 | 자동 |
|---|
사고
| 공급사 파라미터 | thinking.type |
|---|---|
| 허용 값 | enabled · disabled |
| 기본값 | enabled, 사고 여부는 모델이 자동으로 판단 요청에서 지정하지 않을 때 적용 |
| 비활성화 가능 | 지원 |
| 사고 동작 | 트레이스는 reasoning_content로 반환됩니다. 이전 턴의 트레이스는 기본적으로 삭제되며(clear_thinking true), 인터리브드 사고 블록은 보존해 도구 결과와 함께 반환하는 것이 좋습니다. |
| 파라미터 | reasoning_effort |
| 값 | minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다 |
모델
| 모달리티 | 텍스트 → 텍스트 |
|---|
- OpenClaw 에이전트 시나리오에 맞춰 튜닝된 API 전용 속도 최적화 GLM-5 변형: 더 안정적인 도구 호출과 장시간 실행 과제의 안정성
- 200K 컨텍스트 / 128K 최대 출력
출처: Z.ai 공식 문서 ↗
30초 만에 GLM-5-Turbo 사용하기
OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="glm-5-turbo",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "glm-5-turbo",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-turbo",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "glm-5-turbo",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("glm-5-turbo")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));GLM-5-Turbo 소개
- 기본 GLM-5와 비교해 공식 문서는 네 가지 표적 업그레이드를 강조합니다.
- 더 정확한 도구 호출, 복잡한 지시의 더 강한 분해, 예약·지속 과제에 대한 시간 인지 처리, 그리고 긴 논리 사슬에서의 더 높은 처리량입니다.
- 200K 컨텍스트 윈도우와 최대 128K 출력 토큰을 제공하며, 사고 모드, 스트리밍, 함수 호출, 컨텍스트 캐싱, 구조화 JSON 출력, MCP 도구 통합을 갖추고 있습니다.
- Z.AI는 이 릴리스를 원시 지능이 아니라 롱 체인 에이전트 과제에서의 안정성과 효율 개선으로 규정하고, 튜닝 대상이 된 도메인을 열거합니다.
- 설치와 구성, 코드 개발, 정보 수집, 데이터 분석, 콘텐츠 제작, 사무 생산성, 재무 분석, 운영 엔지니어링, 리서치입니다.
- 그 목록이 이 모델을 정직하게 읽는 방법입니다.
- 범용 형제 모델이 아니라 에이전트 하네스 특화 모델입니다.
- 사고는 GLM-5와 같은 관례를 따라 기본으로 켜져 있고 추론 여부는 모델이 정하며, 트레이스는 답변과 분리되어 반환됩니다.
- 도구와 함께 외부 스킬을 호출할 수 있고, 도구 호출 인자는 증분으로 스트리밍할 수 있습니다.
- 이 라인의 나머지와 구별되는 점이 두 가지 있습니다.
- Z.AI는 파라미터 수를 공개하지 않으며, GLM-5, 5.1, 5.2와 달리 오픈 웨이트 릴리스가 없습니다.
- API 전용입니다.
- Synthorai에서 GLM-5-Turbo는 표준 OpenAI 호환 API로 호출할 수 있습니다.
자주 묻는 질문
GLM-5-Turbo API는 무료로 사용해 볼 수 있나요?
네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $1.2/M 기준으로, 이 크레딧만으로도 GLM-5-Turbo에 약 8K 토큰 규모의 요청을 대략 104회 보낼 수 있습니다.
GLM-5-Turbo는 무엇에 가장 강한가요?
OpenClaw 에이전트 시나리오에 심층 최적화, 더 정밀한 도구 호출과 지시 분해, 예약·상시 작업의 시간 인지 처리. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.
GLM-5-Turbo의 가격은 얼마인가요?
Synthorai에서 GLM-5-Turbo는 입력 토큰 100만 개당 $1.2, 출력 토큰 100만 개당 $4입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.24/M로 과금됩니다.
GLM-5-Turbo는 프롬프트 캐싱을 지원하나요?
네, 자동으로 지원합니다. Z.ai에서 서빙되는 프롬프트는 코드 변경 없이 캐시됩니다. 캐시된 입력 토큰은 $0.24/M로 과금됩니다(미캐시 시 $1.2/M). 프롬프트 캐싱 가이드 →
GLM-5-Turbo는 어떻게 이용하나요?
기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="glm-5-turbo"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.
관련 모델
비교
이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.