新規 無料登録で、呼び出し 10 回分(最大 $1)をお試しいただけます。カード登録は不要です。

Gemini 3.6 Flash vs MiniMax M3

MiniMax M3 は当社のカタログでの提供を終了しました。以下の数値は最後に公開された料金です。このモデルは呼び出せなくなっていますが、比較対象のもう一方のモデルは引き続き利用できます。

vs

どんなときに、どちらを選ぶか

音声が絡むなら gemini-3.6-flash を選んでください。テキスト・画像・動画に加えて音声入力を受け付けるのは 2 つのうちこちらだけで(100万音声トークンあたり $5、キャッシュ $0.5)、1048576 トークンのコンテキストは相手の 1000000 をわずかに上回ります。minimax-m3 は100万トークンあたり入力 $0.3、出力 $1.2 で、$1.5 と $7.5 に対して入力は 5 分の 1、出力は 6.25 分の 1、さらに最大 524288 出力トークンを許容します(gemini-3.6-flash は 65536 が上限)。minimax-m3 は思考を無効化でき、推論と長コンテキストのフラグを備えますが、gemini-3.6-flash は常に思考します。

ベンチマーク

MiniMax M3:ベンダーがベンチマークスコアを公表していません。

平均超え上回るモデルなしGemini 3.6 Flash6 / 191 / 19
Gemini 3.6 Flash MiniMax M3 測定された他モデル 他モデルの平均 ★ これを上回るモデルなし
DeepSWE 1.1
48.6%
N/A
BioMysteryBench hard
41.2%
N/A
OSWorld 2.0
33.8%
N/A
GDPval-AA v2 Elo · 1422-1598 Google 公表 · 2026-08-25
1422
N/A
Harvey Lab-AA
85.1%
N/A
HLE-Verified
51.2%
N/A
AutomationBench
17%
N/A
LVBench
84.2%
N/A

ベンダー公表値: Alibaba (Qwen) Anthropic DeepSeek Google Moonshot OpenAI Tencent Z.ai

料金

Gemini 3.6 Flash MiniMax M3 Δ
入力 / 100 万トークン $1.5 $0.3 5×
出力 / 100 万トークン $7.5 $1.2 6.3×
キャッシュ読み取り / 100 万トークン $0.15 $0.06 2.5×
キャッシュ書き込み - 追加料金なし -

ビルド時点の現行カタログの料金です。最新の料金表は各モデルのページに掲載しています。

両モデルの位置:100 万トークンあたりの入力料金(この課金単位のチャットモデル全 76 件、対数スケール)

Gemini 3.6 Flash · $1.5 MiniMax M3 · $0.3
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

対応機能

Gemini 3.6 Flash MiniMax M3
ツール呼び出し あり あり
思考の制御 常時オン 設定可能
構造化出力 あり -
プロンプトキャッシュ 自動 + 明示 自動(暗黙的)
キャッシュ保持時間 公表なし 公表なし
キャッシュ対象の最小プレフィックス 4096 トークン 512 トークン

仕様

Gemini 3.6 Flash MiniMax M3
入力モダリティ テキスト 画像 音声 動画 テキスト 画像 動画
出力モダリティ テキスト テキスト
リリース 2026-07-21 2026-06-01
知識カットオフ 2026-03 -
コンテキストウィンドウ 1M 1M
最大出力 66K 524K
思考パラメータ thinkingLevel
  • thinking.type
  • reasoning_split
指定可能な値
  • minimal
  • low
  • medium
  • high
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
デフォルト medium adaptive: thinking on, with the model deciding when extra reasoning helps

仕様は各ベンダーのドキュメントから転記しています。ベンダーが公表していない項目は、推測で埋めずに省いています。 出典の一覧: Gemini 3.6 Flash · MiniMax M3

1 行の変更で切り替え

以下のどのタブにも両方のモデル ID が入っています。書き換えるのはハイライトされた 2 行だけで、エンドポイント、キー、リクエスト形式はすべて同じです。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.6-flash",
    # model="minimax-m3",  # この行のコメントを外し、上の行をコメントアウト
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

API キーを取得 →

よくある質問

Gemini 3.6 Flash と MiniMax M3 ではどちらが安いですか?

入力 / 100 万トークンは MiniMax M3 のほうが安くなります($0.3 対 $1.5、5.0 倍の差)。ほかの行では逆になることもあります。料金の全体は上の表に掲載しており、実際のコストは利用の内訳によって変わります。

Gemini 3.6 Flash と MiniMax M3 の A/B テストは、実装を 2 つ用意せずにできますか?

はい。どちらも同じ OpenAI 互換エンドポイントから 1 つの API キーで利用できます。切り替えはモデル名の文字列を 1 行変えるだけなので、トラフィックの一部をそれぞれに振り分けて、請求額を直接比較できます。

Gemini 3.6 Flash と MiniMax M3 はプロンプトキャッシュに対応していますか?

はい。どちらのモデルも、キャッシュ読み取りは通常の入力単価より安く課金されます。そのため、同じプレフィックスを繰り返し使うワークロードでは、定価から見込まれるよりコストが下がります。キャッシュ読み取りの正確な単価は、上の料金表に掲載しています。

関連する比較

当社の実測レポートより