Claude Fable 5.1 vs Qwen3.8 Max
Claude Fable 5.1 は招待制で提供されています。下記の数値は実際のライブレートですが、呼び出しにはまずワークスペースの権限付与が必要となるため、この比較を基に開発を行う前にアクセス権限をご依頼ください。
いつ、どちらを使うか
どちらもテキストと画像を入力として受け取りテキストを返し、$0.25のキャッシュ読み込みレートを共有し、容量は互いにほぼ誤差の範囲内です - claude-fable-5-1のコンテキストトークン数は1000000、最大出力は128000ですが、qwen3.8-maxはそれぞれ983616と131072です。違いは料金表にあります: qwen3.8-maxが入力$2、出力$6であるのに対し、claude-fable-5-1は$10と$50であるため、入力で5x、出力で8x強の価格となり、これは長い生成時に最も重要になります。常時オンのthinking modeが必要な場合はclaude-fable-5-1を、わずかなコストで大量の処理を行う場合はqwen3.8-maxを選択してください。
ベンチマーク
ベンダー公表: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
料金
| Claude Fable 5.1 | Qwen3.8 Max | Δ | |
|---|---|---|---|
| 入力 / 1Mトークン | $10 | $2 | 5× |
| 出力 / 1Mトークン | $50 | $6 | 8.3× |
| キャッシュ読み取り / 1Mトークン | $0.25 | $0.25 | = |
| キャッシュ書き込み | 1.25x (5m) / 2x (1h) | 1.25x | - |
ビルド時のライブカタログの料金です。各モデルのページには現在の料金カードが記載されています。
位置付け — この課金単位におけるすべての67個のチャットモデル全体の1Mトークンあたりの入力料金 (対数スケール)
機能
| Claude Fable 5.1 | Qwen3.8 Max | |
|---|---|---|
| ツール使用 | あり | あり |
| 思考コントロール | 常時オン | あり — ベンダーの調整パラメータは非公開 |
| 構造化出力 | あり | あり |
| プロンプトキャッシング | 明示的 (プレフィックスを自分で指定) | 暗黙的 + 明示的 |
| キャッシュ有効期間 | 5m default, 1h option | explicit: 5m, reset on hit |
| 最小キャッシュプレフィックス | 1024 トークン | 1024 トークン |
仕様
| Claude Fable 5.1 | Qwen3.8 Max | |
|---|---|---|
| 入力モダリティ | テキスト 画像 | テキスト 画像 |
| 出力モダリティ | テキスト | テキスト |
| リリース | 2026-09-01 | 2026-08-03 |
| 知識のカットオフ | 2026-06 | - |
| コンテキストウィンドウ | 1M | 984K |
| 最大出力 | 128K | 131K |
| 思考パラメータ | output_config.effort (thinking is adaptive-only and always on) | - |
| 指定可能な値 | effort
| - |
| デフォルト | thinking always on (adaptive) effort
| - |
仕様は各ベンダーのドキュメントから転記されています。ベンダーが公開していない行は推測せず、省略しています。 すべての出典: Claude Fable 5.1 · Qwen3.8 Max
1行で切り替え
以下のすべてのタブには両方のIDが含まれています — 変更箇所はハイライトされた2行のみです。エンドポイント、キー、リクエスト形式はすべて同じです。
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="claude-fable-5-1",
# model="qwen3.8-max", # この行をアンコメントし、上の行をコメントアウトします
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "claude-fable-5-1",
// model: "qwen3.8-max", // この行をアンコメントし、上の行をコメントアウトします
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "claude-fable-5-1",
# "model": "qwen3.8-max", # この行をアンコメントし、上の行をコメントアウトします
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "claude-fable-5-1",
// Model: "qwen3.8-max", // この行をアンコメントし、上の行をコメントアウトします
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("claude-fable-5-1")
// .model("qwen3.8-max") // この行をアンコメントし、上の行をコメントアウトします
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));FAQ
Claude Fable 5.1 と Qwen3.8 Max ではどちらが安いですか?
入力 / 1mトークン においては Qwen3.8 Max の方が安価です($2 対 $10、5.0× の差)。他の行では逆になる可能性があります — 上の表には完全な情報が記載されており、実際のコストは組み合わせに依存します。
2つの統合を行わずに Claude Fable 5.1 と Qwen3.8 Max のA/Bテストを実施できますか?
はい。両方とも1つのAPIキーで同じOpenAI互換エンドポイントを通じて提供されます — モデル文字列を1行変更するだけで切り替えられるため、トラフィックの一部をそれぞれにルーティングし、請求額を直接比較できます。
Claude Fable 5.1 と Qwen3.8 Max はプロンプトキャッシングをサポートしていますか?
はい — どちらのモデルでもキャッシュ読み込みは入力レートよりも低く請求されるため、ウォームプレフィックスのワークロードは定価が示すよりも低コストになります。キャッシュ読み込みの正確な行は、上の料金表に記載されています。