新規 無料登録で、呼び出し 10 回分(最大 $1)をお試しいただけます。カード登録は不要です。

MiniMax M3 vs Qwen3.8 Max

MiniMax M3 は当社のカタログでの提供を終了しました。以下の数値は最後に公開された料金です。このモデルは呼び出せなくなっていますが、比較対象のもう一方のモデルは引き続き利用できます。

vs

どんなときに、どちらを選ぶか

minimax-m3 は料金表のどの行でも安く、入力 $0.3、出力 $1.2 が qwen3.8-max の $2 と $6 に対しておよそ 6.7 分の 1 と 5 分の 1 です。さらにテキストと画像に加えて動画も受け付け、1000000 トークンのコンテキストと最大 524288 トークンの出力を備え、思考を切ることもできます。qwen3.8-max は高価で出力上限は 131072 トークン、コンテキストは 983616 トークンなので、テキストと画像の処理で明示的なビジョンフラグを備えた Alibaba の新しい 2026 年 8 月モデルが欲しいときに使ってください。大量・長出力・動画入力の仕事なら minimax-m3 が経済的な選択です。

ベンチマーク

MiniMax M3:ベンダーがベンチマークスコアを公表していません。

平均超え上回るモデルなしQwen3.8 Max31 / 408 / 40
MiniMax M3 Qwen3.8 Max 測定された他モデル 他モデルの平均 ★ これを上回るモデルなし
SWE-Bench Pro
N/A
67.7%
AndroidBench
N/A
75.1%
Cybergym
N/A
78.5%
HealthBench
N/A
これを上回るモデルなし 60.2%
JobBench
N/A
53.4%
PLawBench
N/A
これを上回るモデルなし 73.2%
GPQA Diamond
N/A
92.6%
Agents' Last Exam
N/A
27%

ベンダー公表値: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

料金

MiniMax M3 Qwen3.8 Max Δ
入力 / 100 万トークン $0.3 $2 0.15×
出力 / 100 万トークン $1.2 $6 0.2×
キャッシュ読み取り / 100 万トークン $0.06 $0.25 0.24×
キャッシュ書き込み 追加料金なし 1.25x -

ビルド時点の現行カタログの料金です。最新の料金表は各モデルのページに掲載しています。

両モデルの位置:100 万トークンあたりの入力料金(この課金単位のチャットモデル全 76 件、対数スケール)

MiniMax M3 · $0.3 Qwen3.8 Max · $2
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

対応機能

MiniMax M3 Qwen3.8 Max
ツール呼び出し あり あり
思考の制御 設定可能 あり(ベンダーは調整用パラメータを公表していない)
構造化出力 - あり
プロンプトキャッシュ 自動(暗黙的) 自動 + 明示
キャッシュ保持時間 公表なし explicit: 5m, reset on hit
キャッシュ対象の最小プレフィックス 512 トークン 1024 トークン

仕様

MiniMax M3 Qwen3.8 Max
入力モダリティ テキスト 画像 動画 テキスト 画像
出力モダリティ テキスト テキスト
リリース 2026-06-01 2026-08-03
コンテキストウィンドウ 1M 984K
最大出力 524K 131K
思考パラメータ
  • thinking.type
  • reasoning_split
-
指定可能な値
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
-
デフォルト adaptive: thinking on, with the model deciding when extra reasoning helps -

仕様は各ベンダーのドキュメントから転記しています。ベンダーが公表していない項目は、推測で埋めずに省いています。 出典の一覧: MiniMax M3 · Qwen3.8 Max

1 行の変更で切り替え

以下のどのタブにも両方のモデル ID が入っています。書き換えるのはハイライトされた 2 行だけで、エンドポイント、キー、リクエスト形式はすべて同じです。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="minimax-m3",
    # model="qwen3.8-max",  # この行のコメントを外し、上の行をコメントアウト
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API キーを取得 →

よくある質問

MiniMax M3 と Qwen3.8 Max ではどちらが安いですか?

入力 / 100 万トークンは MiniMax M3 のほうが安くなります($0.3 対 $2、6.7 倍の差)。ほかの行では逆になることもあります。料金の全体は上の表に掲載しており、実際のコストは利用の内訳によって変わります。

MiniMax M3 と Qwen3.8 Max の A/B テストは、実装を 2 つ用意せずにできますか?

はい。どちらも同じ OpenAI 互換エンドポイントから 1 つの API キーで利用できます。切り替えはモデル名の文字列を 1 行変えるだけなので、トラフィックの一部をそれぞれに振り分けて、請求額を直接比較できます。

MiniMax M3 と Qwen3.8 Max はプロンプトキャッシュに対応していますか?

はい。どちらのモデルも、キャッシュ読み取りは通常の入力単価より安く課金されます。そのため、同じプレフィックスを繰り返し使うワークロードでは、定価から見込まれるよりコストが下がります。キャッシュ読み取りの正確な単価は、上の料金表に掲載しています。

関連する比較

当社の実測レポートより