新規 無料登録、10回の呼び出しを進呈。最大 $1、カード不要。

Claude Fable 5.1 vs GLM-5.3-Flash

Claude Fable 5.1 は招待制で提供されています。下記の数値は実際のライブレートですが、呼び出しにはまずワークスペースの権限付与が必要となるため、この比較を基に開発を行う前にアクセス権限をご依頼ください。

vs

いつ、どちらを使うか

両モデルとも1Mトークンのコンテキストウィンドウを持ち、どちらも思考をオフにできないため、実質的な違いは価格と入力になります。glm-5.3-flashは入力$0.15、出力$0.5であるのに対し、claude-fable-5-1は$10と$50で、およそ67xおよび100x安価であり、またテキストと画像に加えてビデオも受け付け、最大出力トークン数も128000に対して最大163840を許容します。100万トークンあたりのコストが重要となる大量処理やビデオ入力の作業、およびより安価な$0.03のキャッシュ読み取りにはglm-5.3-flashを採用してください。2026-06の知識カットオフを持つAnthropicのより新しい世代を求める場合は、claude-fable-5-1を選択してください。

ベンチマーク

平均超え他モデル以上Claude Fable 5.17 / 77 / 7GLM-5.3-Flash4 / 50 / 5
Claude Fable 5.1 GLM-5.3-Flash 測定された他モデル 測定対象の平均 他モデルに上回られていない
Terminal-Bench 2.1
N/A
84.3%
OSWorld 2.0 partial
77.9%
N/A
GDPval-AA v2 Elo · 1711-1853 Anthropic 公表 · 2026-09-05
他モデルに上回られていない 1853
N/A
Humanity's Last Exam with tools
他モデルに上回られていない 65%
55.3%
Agents' Last Exam
N/A
26.3%

ベンダー公表: Alibaba (Qwen) Anthropic DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

料金

Claude Fable 5.1 GLM-5.3-Flash Δ
入力 / 1Mトークン $10 $0.15 67×
出力 / 1Mトークン $50 $0.5 100×
キャッシュ読み取り / 1Mトークン $0.25 $0.03 8.3×
キャッシュ書き込み 1.25x (5m) / 2x (1h) - -

ビルド時のライブカタログの料金です。各モデルのページには現在の料金カードが記載されています。

位置付け — この課金単位におけるすべての67個のチャットモデル全体の1Mトークンあたりの入力料金 (対数スケール)

$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

機能

Claude Fable 5.1 GLM-5.3-Flash
ツール使用 あり あり
思考コントロール 常時オン 常時オン
構造化出力 あり あり
プロンプトキャッシング 明示的 (プレフィックスを自分で指定) 暗黙的 (自動)
キャッシュ有効期間 5m default, 1h option 非公開
最小キャッシュプレフィックス 1024 トークン 非公開

仕様

Claude Fable 5.1 GLM-5.3-Flash
入力モダリティ テキスト 画像 テキスト 画像 動画
出力モダリティ テキスト テキスト
リリース 2026-09-01 -
知識のカットオフ 2026-06 -
コンテキストウィンドウ 1M 1M
最大出力 128K 164K
思考パラメータ output_config.effort (thinking is adaptive-only and always on) reasoning_effort
指定可能な値
effort
  • low
  • medium
  • high
  • xhigh
  • max
reasoning_effort
  • low
  • high
  • max
デフォルト

thinking always on (adaptive)

effort
  • high
max

仕様は各ベンダーのドキュメントから転記されています。ベンダーが公開していない行は推測せず、省略しています。 すべての出典: Claude Fable 5.1 · GLM-5.3-Flash

1行で切り替え

以下のすべてのタブには両方のIDが含まれています — 変更箇所はハイライトされた2行のみです。エンドポイント、キー、リクエスト形式はすべて同じです。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="claude-fable-5-1",
    # model="glm-5.3-flash",  # この行をアンコメントし、上の行をコメントアウトします
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API キーを取得 →

FAQ

Claude Fable 5.1 と GLM-5.3-Flash ではどちらが安いですか?

入力 / 1mトークン においては GLM-5.3-Flash の方が安価です($0.15 対 $10、67× の差)。他の行では逆になる可能性があります — 上の表には完全な情報が記載されており、実際のコストは組み合わせに依存します。

2つの統合を行わずに Claude Fable 5.1 と GLM-5.3-Flash のA/Bテストを実施できますか?

はい。両方とも1つのAPIキーで同じOpenAI互換エンドポイントを通じて提供されます — モデル文字列を1行変更するだけで切り替えられるため、トラフィックの一部をそれぞれにルーティングし、請求額を直接比較できます。

Claude Fable 5.1 と GLM-5.3-Flash はプロンプトキャッシングをサポートしていますか?

はい — どちらのモデルでもキャッシュ読み込みは入力レートよりも低く請求されるため、ウォームプレフィックスのワークロードは定価が示すよりも低コストになります。キャッシュ読み込みの正確な行は、上の料金表に記載されています。

関連する比較

当社の測定調査より