新帳號 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Gemini 3.6 Flash vs MiniMax M3

MiniMax M3 已從我們的目錄下架。下方是它最後公布的費率;它已經無法呼叫,這組比較裡的另一個模型則仍可呼叫。

vs

什麼情況選哪一個

涉及音訊時選 gemini-3.6-flash:它是兩者中唯一在文字、影像和視訊之外還接受音訊輸入的(每百萬音訊 token $5,快取 $0.5),而且它 1048576 token 的脈絡略勝對方的 1000000。minimax-m3 每百萬輸入 $0.3、輸出 $1.2,對比 $1.5 和 $7.5,即輸入便宜 5 倍、輸出便宜 6.25 倍,並且允許最多 524288 輸出 token,而 gemini-3.6-flash 上限是 65536。minimax-m3 還允許關閉思考,並標記了推理和長脈絡能力,而 gemini-3.6-flash 始終在思考。

Benchmark 成績

MiniMax M3:供應商沒有公布 benchmark 成績。

高於平均沒有模型更高Gemini 3.6 Flash6 / 191 / 19
Gemini 3.6 Flash MiniMax M3 其他有成績的模型 其他模型平均 ★ 沒有模型分數更高
DeepSWE 1.1
48.6%
N/A
BioMysteryBench hard
41.2%
N/A
OSWorld 2.0
33.8%
N/A
GDPval-AA v2 Elo · 1422-1598 據 Google 公布 · 2026-08-25
1422
N/A
Harvey Lab-AA
85.1%
N/A
HLE-Verified
51.2%
N/A
AutomationBench
17%
N/A
LVBench
84.2%
N/A

供應商公布: Alibaba (Qwen) Anthropic DeepSeek Google Moonshot OpenAI Tencent Z.ai

定價

Gemini 3.6 Flash MiniMax M3 Δ
輸入 / 1M tokens $1.5 $0.3 5×
輸出 / 1M tokens $7.5 $1.2 6.3×
快取讀取 / 1M tokens $0.15 $0.06 2.5×
快取寫入 - 不額外計費 -

費率取自網站建置時的即時目錄;各模型頁面都列有最新的價目。

兩者的相對位置:每 1M tokens 的輸入價格,涵蓋同一計費單位下全部 76 個聊天模型(對數尺度)

Gemini 3.6 Flash · $1.5 MiniMax M3 · $0.3
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

功能

Gemini 3.6 Flash MiniMax M3
工具使用 是 是
思考控制 一律開啟 可設定
結構化輸出 是 -
提示詞快取 隱式 + 顯式 隱式(自動)
快取存活時間 未公布 未公布
最小快取前綴 4096 個 token 512 個 token

規格

Gemini 3.6 Flash MiniMax M3
輸入模態 文字 圖像 音訊 影片 文字 圖像 影片
輸出模態 文字 文字
發布日期 2026-07-21 2026-06-01
知識截止日期 2026-03 -
上下文視窗 1M 1M
最大輸出 66K 524K
思考參數 thinkingLevel
  • thinking.type
  • reasoning_split
可接受的值
  • minimal
  • low
  • medium
  • high
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
預設值 medium adaptive: thinking on, with the model deciding when extra reasoning helps

規格摘錄自各供應商的文件;供應商沒有公布的項目就直接略過,不自行推測。 完整來源: Gemini 3.6 Flash · MiniMax M3

改一行程式碼就能在兩者之間切換

下面每個頁籤都列了這兩個模型 ID,要改的只有醒目標示的那兩行。端點、金鑰和請求格式都不變。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.6-flash",
    # model="minimax-m3",  # 取消這一行的註解,並把上一行註解掉
    messages=[{"role": "user", "content": "Summarize this diff"}],
)
print(resp.choices[0].message.content)

取得 API 金鑰 →

常見問題

Gemini 3.6 Flash 和 MiniMax M3 哪個比較便宜?

以「輸入 / 1M tokens」來看,MiniMax M3 比較便宜($0.3 對 $1.5,相差 5.0×)。其他項目的結果可能相反,完整價目請看上表;實際成本要看你的用量組合。

可以只串接一次,就對 Gemini 3.6 Flash 和 MiniMax M3 做 A/B 測試嗎?

可以。兩個模型都走同一個 OpenAI 相容端點,用的也是同一把 API 金鑰,切換時只要改一行裡的模型名稱字串。你可以把一部分流量分別導到兩邊,再直接比較帳單。

Gemini 3.6 Flash 與 MiniMax M3 支援提示詞快取嗎?

支援。兩者的快取讀取費率都低於輸入費率,所以前綴已經進快取的工作負載,實際成本會比官網價算出來的低。確切的快取讀取價格請見上方定價表。

相關比較