MiniMax M3 vs Qwen3.8 Max
MiniMax M3 は当社のカタログでの提供を終了しました。以下の数値は最後に公開された料金です。このモデルは呼び出せなくなっていますが、比較対象のもう一方のモデルは引き続き利用できます。
どんなときに、どちらを選ぶか
minimax-m3 は料金表のどの行でも安く、入力 $0.3、出力 $1.2 が qwen3.8-max の $2 と $6 に対しておよそ 6.7 分の 1 と 5 分の 1 です。さらにテキストと画像に加えて動画も受け付け、1000000 トークンのコンテキストと最大 524288 トークンの出力を備え、思考を切ることもできます。qwen3.8-max は高価で出力上限は 131072 トークン、コンテキストは 983616 トークンなので、テキストと画像の処理で明示的なビジョンフラグを備えた Alibaba の新しい 2026 年 8 月モデルが欲しいときに使ってください。大量・長出力・動画入力の仕事なら minimax-m3 が経済的な選択です。
ベンチマーク
MiniMax M3:ベンダーがベンチマークスコアを公表していません。
ベンダー公表値: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
料金
| MiniMax M3 | Qwen3.8 Max | Δ | |
|---|---|---|---|
| 入力 / 100 万トークン | $0.3 | $2 | 0.15× |
| 出力 / 100 万トークン | $1.2 | $6 | 0.2× |
| キャッシュ読み取り / 100 万トークン | $0.06 | $0.25 | 0.24× |
| キャッシュ書き込み | 追加料金なし | 1.25x | - |
ビルド時点の現行カタログの料金です。最新の料金表は各モデルのページに掲載しています。
両モデルの位置:100 万トークンあたりの入力料金(この課金単位のチャットモデル全 76 件、対数スケール)
対応機能
| MiniMax M3 | Qwen3.8 Max | |
|---|---|---|
| ツール呼び出し | あり | あり |
| 思考の制御 | 設定可能 | あり(ベンダーは調整用パラメータを公表していない) |
| 構造化出力 | - | あり |
| プロンプトキャッシュ | 自動(暗黙的) | 自動 + 明示 |
| キャッシュ保持時間 | 公表なし | explicit: 5m, reset on hit |
| キャッシュ対象の最小プレフィックス | 512 トークン | 1024 トークン |
仕様
| MiniMax M3 | Qwen3.8 Max | |
|---|---|---|
| 入力モダリティ | テキスト 画像 動画 | テキスト 画像 |
| 出力モダリティ | テキスト | テキスト |
| リリース | 2026-06-01 | 2026-08-03 |
| コンテキストウィンドウ | 1M | 984K |
| 最大出力 | 524K | 131K |
| 思考パラメータ |
| - |
| 指定可能な値 | thinking.type
reasoning_split
| - |
| デフォルト | adaptive: thinking on, with the model deciding when extra reasoning helps | - |
仕様は各ベンダーのドキュメントから転記しています。ベンダーが公表していない項目は、推測で埋めずに省いています。 出典の一覧: MiniMax M3 · Qwen3.8 Max
1 行の変更で切り替え
以下のどのタブにも両方のモデル ID が入っています。書き換えるのはハイライトされた 2 行だけで、エンドポイント、キー、リクエスト形式はすべて同じです。
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="minimax-m3",
# model="qwen3.8-max", # この行のコメントを外し、上の行をコメントアウト
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "minimax-m3",
// model: "qwen3.8-max", // この行のコメントを外し、上の行をコメントアウト
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
# "model": "qwen3.8-max", # この行のコメントを外し、上の行をコメントアウト
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "minimax-m3",
// Model: "qwen3.8-max", // この行のコメントを外し、上の行をコメントアウト
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("minimax-m3")
// .model("qwen3.8-max") // この行のコメントを外し、上の行をコメントアウト
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));よくある質問
MiniMax M3 と Qwen3.8 Max ではどちらが安いですか?
入力 / 100 万トークンは MiniMax M3 のほうが安くなります($0.3 対 $2、6.7 倍の差)。ほかの行では逆になることもあります。料金の全体は上の表に掲載しており、実際のコストは利用の内訳によって変わります。
MiniMax M3 と Qwen3.8 Max の A/B テストは、実装を 2 つ用意せずにできますか?
はい。どちらも同じ OpenAI 互換エンドポイントから 1 つの API キーで利用できます。切り替えはモデル名の文字列を 1 行変えるだけなので、トラフィックの一部をそれぞれに振り分けて、請求額を直接比較できます。
MiniMax M3 と Qwen3.8 Max はプロンプトキャッシュに対応していますか?
はい。どちらのモデルも、キャッシュ読み取りは通常の入力単価より安く課金されます。そのため、同じプレフィックスを繰り返し使うワークロードでは、定価から見込まれるよりコストが下がります。キャッシュ読み取りの正確な単価は、上の料金表に掲載しています。