MiniMax M3 vs Qwen3.7 Plus
MiniMax M3 は当社のカタログでの提供を終了しました。以下の数値は最後に公開された料金です。このモデルは呼び出せなくなっていますが、比較対象のもう一方のモデルは引き続き利用できます。
どんなときに、どちらを選ぶか
この 2 つは紙の上では非常に近いです。minimax-m3 も qwen3.7-plus も 1000000 トークンのコンテキスト、テキスト/画像/動画の入力とテキスト出力、同じチャット・コード・推論・ツール・長コンテキストのフラグを備え、思考を無効化でき、どちらも 2026-06-01 リリースです。分かれ目は料金表と出力の上限で、qwen3.7-plus は入力($0.4 対 $0.3)、出力($1.6 対 $1.2)、キャッシュ読み取り($0.08 対 $0.06)のいずれも minimax-m3 のおよそ 1.33 倍、一方 minimax-m3 は 65536 ではなく 524288 の最大出力トークン、つまり 8 倍の余地を許容します。安価な実行と非常に長い単発生成なら minimax-m3 を、ベンダーとして Alibaba を好むなら qwen3.7-plus を選んでください。
ベンチマーク
MiniMax M3:ベンダーがベンチマークスコアを公表していません。
ベンダー公表値: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
料金
| MiniMax M3 | Qwen3.7 Plus | Δ | |
|---|---|---|---|
| 入力 / 100 万トークン | $0.3 | $0.4 | 0.75× |
| 出力 / 100 万トークン | $1.2 | $1.6 | 0.75× |
| キャッシュ読み取り / 100 万トークン | $0.06 | $0.08 | 0.75× |
| キャッシュ書き込み | 追加料金なし | 1.25x | - |
ビルド時点の現行カタログの料金です。最新の料金表は各モデルのページに掲載しています。
両モデルの位置:100 万トークンあたりの入力料金(この課金単位のチャットモデル全 76 件、対数スケール)
対応機能
| MiniMax M3 | Qwen3.7 Plus | |
|---|---|---|
| ツール呼び出し | あり | あり |
| 思考の制御 | 設定可能 | 設定可能 |
| 構造化出力 | - | あり |
| プロンプトキャッシュ | 自動(暗黙的) | 自動 + 明示 |
| キャッシュ保持時間 | 公表なし | explicit: 5m, reset on hit |
| キャッシュ対象の最小プレフィックス | 512 トークン | 1024 トークン |
仕様
| MiniMax M3 | Qwen3.7 Plus | |
|---|---|---|
| 入力モダリティ | テキスト 画像 動画 | テキスト 画像 動画 |
| 出力モダリティ | テキスト | テキスト |
| リリース | 2026-06-01 | 2026-06-01 |
| コンテキストウィンドウ | 1M | 1M |
| 最大出力 | 524K | 66K |
| 思考パラメータ |
|
|
| 指定可能な値 | thinking.type
reasoning_split
| enable_thinking
thinking_budget
preserve_thinking
|
| デフォルト | adaptive: thinking on, with the model deciding when extra reasoning helps | on the Qwen3.7 Plus series is hybrid thinking with thinking enabled by default, and preserve_thinking is off |
仕様は各ベンダーのドキュメントから転記しています。ベンダーが公表していない項目は、推測で埋めずに省いています。 出典の一覧: MiniMax M3 · Qwen3.7 Plus
1 行の変更で切り替え
以下のどのタブにも両方のモデル ID が入っています。書き換えるのはハイライトされた 2 行だけで、エンドポイント、キー、リクエスト形式はすべて同じです。
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="minimax-m3",
# model="qwen3.7-plus", # この行のコメントを外し、上の行をコメントアウト
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "minimax-m3",
// model: "qwen3.7-plus", // この行のコメントを外し、上の行をコメントアウト
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
# "model": "qwen3.7-plus", # この行のコメントを外し、上の行をコメントアウト
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "minimax-m3",
// Model: "qwen3.7-plus", // この行のコメントを外し、上の行をコメントアウト
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("minimax-m3")
// .model("qwen3.7-plus") // この行のコメントを外し、上の行をコメントアウト
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));よくある質問
MiniMax M3 と Qwen3.7 Plus ではどちらが安いですか?
入力 / 100 万トークンは MiniMax M3 のほうが安くなります($0.3 対 $0.4、1.3 倍の差)。ほかの行では逆になることもあります。料金の全体は上の表に掲載しており、実際のコストは利用の内訳によって変わります。
MiniMax M3 と Qwen3.7 Plus の A/B テストは、実装を 2 つ用意せずにできますか?
はい。どちらも同じ OpenAI 互換エンドポイントから 1 つの API キーで利用できます。切り替えはモデル名の文字列を 1 行変えるだけなので、トラフィックの一部をそれぞれに振り分けて、請求額を直接比較できます。
MiniMax M3 と Qwen3.7 Plus はプロンプトキャッシュに対応していますか?
はい。どちらのモデルも、キャッシュ読み取りは通常の入力単価より安く課金されます。そのため、同じプレフィックスを繰り返し使うワークロードでは、定価から見込まれるよりコストが下がります。キャッシュ読み取りの正確な単価は、上の料金表に掲載しています。