Qwen3.8 Max
ベンダー定価。プラットフォーム手数料なし、従量課金。 これらは公式 list 価格です。ログイン中のお客様は /console/pricing でワークスペース割引を含む実効価格を確認できます。 キャッシュヒット率 70% 時の実効入力単価:$0.775/M. 暗黙的コンテキストキャッシュは自動です。明示的な cache_control モードはより深い割引を提供します(1,024 トークンの最小ブロック、ヒット時にリセットされる 5 分 TTL)。モデルごとのキャッシュ読み取り価格は料金表にあります。
30 秒で Qwen3.8 Max を使う
OpenAI 互換。base_url を差し替えるだけで、SDK はそのまま。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3.8-max",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-max",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3.8-max",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3.8-max")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));スペックと制限
トークン
- コンテキストウィンドウ(ベンダー仕様)
- 983,616
- 最大出力(ベンダー仕様)
- 131,072
プロンプトキャッシュ
- キャッシュ方式
- 自動 + 明示
- 保持時間
- 明示的モード: 5 分、ヒット時にリセット
思考
- パラメータ
- reasoning_effort
- 値
- minimal · low · medium · high 受け付ける範囲はプロバイダー次第
モデル
- モダリティ
- テキスト + 画像 → テキスト
- パラメータ数
- 合計 2.4T MoE
- Flagship Qwen3.8 Max: natively vision-language, 2.4T-parameter MoE
- thinking trace returned in reasoning_content
- text and image in, text out
Qwen3.8 Max について
Qwen3.8 Max はアリババが 2026 年 8 月 3 日に公開した Qwen シリーズの旗艦モデルです。
- 公式の説明では、Mixture-of-Experts アーキテクチャ上に構築されたパラメータ 2.4 兆のネイティブな視覚言語 Max モデルであり、Qwen 系列でこれまでで最も高性能なモデルとされています。
- テキストと画像を受け取ってテキストを返すため、プロンプトとスクリーンショット、図表、スキャン画像を 1 回のリクエストにまとめられ、画像を別の視覚モデルに回す必要がありません。
- 思考は既定動作の一部で、推論トレースは reasoning_content フィールドに分離して返されます。
- つまり短い返答でも推論トークンを消費し、max_tokens をごく小さくするとリクエストは成功しても本文が空で返ることがあります。
- 関数呼び出し、厳密な JSON スキーマによる構造化出力、最終チャンクに usage を含むストリーミングがいずれも利用でき、既存の OpenAI 互換の実装に特別な処理なしで組み込めます。
- コンテキストは 100 万トークン弱、1 回の応答は最大 131,072 トークンで、前世代 Max の出力上限の 2 倍にあたり、長文生成を移す具体的な理由になります。
- 料金はコンテキスト長ではなくキャッシュの挙動で段階が分かれ、標準の入力単価、自動キャッシュヒット時の割安な単価、明示的なキャッシュの作成と読み取りそれぞれの単価が用意されているため、安定したプレフィックスを再利用するエージェントのループは実質的な恩恵を受けます。
- アリババは提供リージョンとして北京とシンガポールを挙げています。
- Synthorai は OpenAI 互換の chat completions エンドポイント経由で提供します。
よくある質問
Qwen3.8 Max API は無料で試せますか?
はい。新規アカウントには 10 回のトライアル呼び出しと最大 $1 の無料クレジットが付与され、カード登録は不要です。入力 $2/M で計算すると、このクレジットだけで Qwen3.8 Max に対して約 62 回の ~8K トークンのリクエストを送れます。
Qwen3.8 Max は何が得意ですか?
2.4 兆パラメータの MoE、ネイティブ視覚言語、テキストと画像入力、最大 131K 出力、キャッシュ段階制の料金。全体像はベンダー公式のリリースノートに基づく「このモデルについて」セクションをご覧ください。
Qwen3.8 Max の料金はいくらですか?
Synthorai 上の Qwen3.8 Max は入力 100 万トークンあたり $2、出力 100 万トークンあたり $6 です。ベンダー定価のままで、プラットフォーム手数料はありません。キャッシュ済み入力トークンは $0.25/M で課金されます。
Qwen3.8 Max はプロンプトキャッシュに対応していますか?
はい。自動キャッシュがデフォルトで有効なうえ、確実な割引を得られる明示モードもあります。キャッシュ済み入力トークンは $0.25/M(未キャッシュは $2/M)で課金されます(TTL 明示的モード: 5 分、ヒット時にリセット)。 プロンプトキャッシュガイド →
Qwen3.8 Max を利用するには?
お使いの OpenAI SDK の base_url を "https://synthorai.io/v1" に向け、model="qwen3.8-max" を設定すれば完了です。API キー 1 本でゲートウェイ上のすべてのモデルを利用できます。