新規 無料登録、10回の呼び出しを進呈。最大 $1、カード不要。
このモデルは現行カタログから退役しました。以下の情報はアーカイブです。

GLM-5-Turbo

2026-03-15 リリース

chatコードリーズニングツール呼び出しプロンプトキャッシュ

GLM-5-Turbo は OpenClaw エージェントシナリオ向けに深く最適化された Z.AI の基盤モデルです。

入力
テキスト $1.2/M
出力
テキスト $4/M
キャッシュ読み取り
$0.24/M
コンテキスト
205K
GPT-4o 比
約 76% 割安

価格の位置づけ

同種 60 モデル中の料金の位置

入力$1.2/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
出力$4/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
キャッシュ読み取り$0.24/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

このバーは、Synthorai 上の同種モデルの中でこのモデルの価格がどこに位置するかを示します。両端には最も安いモデルと最も高いモデルの名前が入ります。表示は基本料金で、バッチ・リージョン・キャッシュ書き込みの割引は料金ページにあります。

スペックと制限

トークン

コンテキストウィンドウ(ベンダー仕様) 200,000
最大出力(ベンダー仕様) 131,072

プロンプトキャッシュ

キャッシュ方式 自動

思考

ベンダー側パラメータ thinking.type
指定可能な値 enabled · disabled
デフォルト enabled。思考するかどうかはモデルが自動で判断します リクエストで未指定の場合に適用
無効化の可否 対応
思考の挙動 トレースは reasoning_content で返ります。過去のターンのトレースはデフォルトで消去され(clear_thinking true)、インターリーブされた思考ブロックは保持してツールの結果と一緒に返すべきです。
パラメータ reasoning_effort
minimal · low · medium · high ゲートウェイ側のパラメータ面——上のベンダーマッピングが適用されます

モデル

モダリティ テキスト → テキスト
  • API 専用で速度に最適化した GLM-5 バリアント。
  • OpenClaw のエージェントシナリオ向けに調整され、ツール呼び出しの信頼性と長時間タスクの安定性が向上しています。
  • 200K コンテキスト / 128K 最大出力。

出典:Z.ai 公式ドキュメント ↗

30 秒で GLM-5-Turbo を使う

OpenAI 互換。base_url を差し替えるだけで、SDK はそのまま。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="glm-5-turbo",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

GLM-5-Turbo について

  • ベースの GLM-5 と比べて、公式ドキュメントは 4 つの的を絞ったアップグレードを強調しています。
  • より精密なツール呼び出し、複雑な指示のより強力な分解、スケジュールされた永続的タスクの時間認識処理、そして長い論理チェーンにおける高いスループットです。
  • 200K コンテキストウィンドウと最大 128K 出力トークンを提供し、思考モード、ストリーミング、関数呼び出し、コンテキストキャッシュ、構造化 JSON 出力、MCP ツール統合を備えます。
  • Z.AI はこのリリースを、素の知能ではなく長いチェーンのエージェントタスクにおける安定性と効率の改善として位置づけ、チューニングの対象とした領域を列挙しています。
  • インストールと設定、コード開発、情報収集、データ分析、コンテンツ制作、オフィス業務、財務分析、運用エンジニアリング、そして研究です。
  • このリストが率直な読み方を示しています。
  • 汎用の兄弟モデルというより、エージェントハーネスの専門家です。
  • 思考は GLM-5 と同じ規約に従い、既定で有効かつ推論するかどうかはモデルが判断し、トレースは回答とは別に返されます。
  • ツールと並んで外部スキルを呼び出すことができ、ツール呼び出しの引数は逐次ストリーミングできます。
  • ラインの他モデルと異なる点が 2 つあります。
  • Z.AI はパラメータ数を公表しておらず、GLM-5、5.1、5.2 と違ってオープンウェイトのリリースがありません。
  • API 専用です。
  • Synthorai では、GLM-5-Turbo は標準の OpenAI 互換 API 経由で呼び出せます。

よくある質問

GLM-5-Turbo API は無料で試せますか?

はい。新規アカウントには 10 回のトライアル呼び出しと最大 $1 の無料クレジットが付与され、カード登録は不要です。入力 $1.2/M で計算すると、このクレジットだけで GLM-5-Turbo に対して約 104 回の ~8K トークンのリクエストを送れます。

GLM-5-Turbo は何が得意ですか?

OpenClaw エージェントシナリオ向けに深く最適化、より精密なツール呼び出しと指示の分解、スケジュールされた永続的タスクの時間認識処理。全体像はベンダー公式のリリースノートに基づく「このモデルについて」セクションをご覧ください。

GLM-5-Turbo の料金はいくらですか?

Synthorai 上の GLM-5-Turbo は入力 100 万トークンあたり $1.2、出力 100 万トークンあたり $4 です。ベンダー定価のままで、プラットフォーム手数料はありません。キャッシュ済み入力トークンは $0.24/M で課金されます。

GLM-5-Turbo はプロンプトキャッシュに対応していますか?

はい、自動で有効です。Z.ai 経由のプロンプトはコード変更なしでキャッシュされます。キャッシュ済み入力トークンは $0.24/M(未キャッシュは $1.2/M)で課金されます。 プロンプトキャッシュガイド →

GLM-5-Turbo を利用するには?

お使いの OpenAI SDK の base_url を "https://synthorai.io/v1" に向け、model="glm-5-turbo" を設定すれば完了です。API キー 1 本でゲートウェイ上のすべてのモデルを利用できます。

関連モデル

比較

このページの値はすべてベンダー自身のドキュメント(上部にリンク)から転記し、確認した日付を付しています。価格はカタログ全体で比較しますが、ベンダーごとに定義が異なる仕様値は差異を明記するにとどめ、図表で比較はしません。当社が測定した数値はなく、スコアも付けていません。

API キーを取得 コストを比較する →