신규 무료 가입, 10회 호출 제공. 최대 $1, 카드 불필요.
이 모델은 현행 카탈로그에서 내려갔습니다. 아래 정보는 아카이브된 내용입니다.

GLM-5-Turbo

2026-03-15 출시

chat코드리즈닝도구 호출프롬프트 캐싱

GLM-5-Turbo는 OpenClaw 에이전트 시나리오에 맞춰 깊이 최적화된 Z.AI 파운데이션 모델입니다.

입력
텍스트 $1.2/M
출력
텍스트 $4/M
캐시 읽기
$0.24/M
컨텍스트
205K
GPT-4o 대비
약 76% 저렴

가격의 위치

동종 60개 모델 중 가격 위치

입력$1.2/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
출력$4/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
캐시 읽기$0.24/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

이 막대는 Synthorai에 있는 같은 종류의 모델 가운데 이 모델의 가격이 어디쯤인지 보여 줍니다. 양쪽 끝에는 가장 싼 모델과 가장 비싼 모델의 이름이 있습니다. 기본 요율 기준이며 배치·리전·캐시 쓰기 할인은 가격 페이지에 있습니다.

스펙 및 제한

토큰

컨텍스트 윈도우(공급사 사양) 200,000
최대 출력(벤더 스펙) 131,072

프롬프트 캐싱

캐싱 방식 자동

사고

공급사 파라미터 thinking.type
허용 값 enabled · disabled
기본값 enabled, 사고 여부는 모델이 자동으로 판단 요청에서 지정하지 않을 때 적용
비활성화 가능 지원
사고 동작 트레이스는 reasoning_content로 반환됩니다. 이전 턴의 트레이스는 기본적으로 삭제되며(clear_thinking true), 인터리브드 사고 블록은 보존해 도구 결과와 함께 반환하는 것이 좋습니다.
파라미터 reasoning_effort
minimal · low · medium · high 게이트웨이 측 파라미터 표면 - 위의 벤더 매핑이 적용됩니다

모델

모달리티 텍스트 → 텍스트
  • OpenClaw 에이전트 시나리오에 맞춰 튜닝된 API 전용 속도 최적화 GLM-5 변형: 더 안정적인 도구 호출과 장시간 실행 과제의 안정성
  • 200K 컨텍스트 / 128K 최대 출력

출처: Z.ai 공식 문서 ↗

30초 만에 GLM-5-Turbo 사용하기

OpenAI 호환. base_url만 바꾸면 SDK는 그대로. POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="glm-5-turbo",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

GLM-5-Turbo 소개

  • 기본 GLM-5와 비교해 공식 문서는 네 가지 표적 업그레이드를 강조합니다.
  • 더 정확한 도구 호출, 복잡한 지시의 더 강한 분해, 예약·지속 과제에 대한 시간 인지 처리, 그리고 긴 논리 사슬에서의 더 높은 처리량입니다.
  • 200K 컨텍스트 윈도우와 최대 128K 출력 토큰을 제공하며, 사고 모드, 스트리밍, 함수 호출, 컨텍스트 캐싱, 구조화 JSON 출력, MCP 도구 통합을 갖추고 있습니다.
  • Z.AI는 이 릴리스를 원시 지능이 아니라 롱 체인 에이전트 과제에서의 안정성과 효율 개선으로 규정하고, 튜닝 대상이 된 도메인을 열거합니다.
  • 설치와 구성, 코드 개발, 정보 수집, 데이터 분석, 콘텐츠 제작, 사무 생산성, 재무 분석, 운영 엔지니어링, 리서치입니다.
  • 그 목록이 이 모델을 정직하게 읽는 방법입니다.
  • 범용 형제 모델이 아니라 에이전트 하네스 특화 모델입니다.
  • 사고는 GLM-5와 같은 관례를 따라 기본으로 켜져 있고 추론 여부는 모델이 정하며, 트레이스는 답변과 분리되어 반환됩니다.
  • 도구와 함께 외부 스킬을 호출할 수 있고, 도구 호출 인자는 증분으로 스트리밍할 수 있습니다.
  • 이 라인의 나머지와 구별되는 점이 두 가지 있습니다.
  • Z.AI는 파라미터 수를 공개하지 않으며, GLM-5, 5.1, 5.2와 달리 오픈 웨이트 릴리스가 없습니다.
  • API 전용입니다.
  • Synthorai에서 GLM-5-Turbo는 표준 OpenAI 호환 API로 호출할 수 있습니다.

자주 묻는 질문

GLM-5-Turbo API는 무료로 사용해 볼 수 있나요?

네, 신규 계정에는 10회의 체험 호출과 최대 $1의 무료 크레딧이 제공되며, 카드 등록이 필요 없습니다. 입력 토큰 $1.2/M 기준으로, 이 크레딧만으로도 GLM-5-Turbo에 약 8K 토큰 규모의 요청을 대략 104회 보낼 수 있습니다.

GLM-5-Turbo는 무엇에 가장 강한가요?

OpenClaw 에이전트 시나리오에 심층 최적화, 더 정밀한 도구 호출과 지시 분해, 예약·상시 작업의 시간 인지 처리. 전체 내용은 벤더의 공식 릴리스 노트를 정리한 소개 섹션을 참고하세요.

GLM-5-Turbo의 가격은 얼마인가요?

Synthorai에서 GLM-5-Turbo는 입력 토큰 100만 개당 $1.2, 출력 토큰 100만 개당 $4입니다. 공급사 정가 그대로이며 플랫폼 마진이 없습니다. 캐시된 입력 토큰은 $0.24/M로 과금됩니다.

GLM-5-Turbo는 프롬프트 캐싱을 지원하나요?

네, 자동으로 지원합니다. Z.ai에서 서빙되는 프롬프트는 코드 변경 없이 캐시됩니다. 캐시된 입력 토큰은 $0.24/M로 과금됩니다(미캐시 시 $1.2/M). 프롬프트 캐싱 가이드 →

GLM-5-Turbo는 어떻게 이용하나요?

기존 OpenAI SDK의 base_url을 "https://synthorai.io/v1"로 지정하고 model="glm-5-turbo"로 설정하면 끝입니다. API 키 하나로 게이트웨이의 모든 모델을 사용할 수 있습니다.

관련 모델

비교

이 페이지의 모든 값은 벤더 자체 문서(위 링크)에서 전사했으며 확인 날짜를 함께 표기합니다. 가격은 카탈로그 전체와 비교하지만, 벤더마다 정의가 다른 사양 값은 차이를 명시할 뿐 도표로 비교하지 않습니다. 저희가 측정한 수치는 없으며 점수도 매기지 않습니다.

API 키 받기 내 비용 비교하기 →