新帳號 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Gemini 3.7 Flash vs MiniMax M3

MiniMax M3 已從我們的目錄下架。下方是它最後公布的費率;它已經無法呼叫,這組比較裡的另一個模型則仍可呼叫。

vs

什麼情況選哪一個

當輸入包含音訊時選 gemini-3.7-flash,它接受文字、影像、音訊和視訊,音訊輸入每百萬 $0.75,快取讀取 $0.075。minimax-m3 在相同單位上更便宜,輸入 $0.3、輸出 $1.2,對比 $0.75 和 $3.75,讀便宜 2.5 倍、寫便宜 3.125 倍,並且允許最多 524288 輸出 token 而非 65536,思考也可以關閉。脈絡基本持平,1048576 對 1000000,兩者都涵蓋對話、視覺、程式碼、工具和推理,所以真正的差別是音訊輸入對價格與長生成的取捨。

Benchmark 成績

MiniMax M3:供應商沒有公布 benchmark 成績。

高於平均沒有模型更高Gemini 3.7 Flash17 / 243 / 24
Gemini 3.7 Flash MiniMax M3 其他有成績的模型 其他模型平均 ★ 沒有模型分數更高
DeepSWE 1.1
65.3%
N/A
BioMysteryBench hard
43.5%
N/A
OSWorld 2.0
47.9%
N/A
Finance Agent v2
59%
N/A
Harvey Lab-AA
90.7%
N/A
HLE-Verified
53.6%
N/A
AutomationBench (v1.0.6)
52.3%
N/A
LVBench
沒有模型分數更高 85.4%
N/A

供應商公布: Alibaba (Qwen) Anthropic DeepSeek Google Moonshot OpenAI Tencent Z.ai

定價

Gemini 3.7 Flash MiniMax M3 Δ
輸入 / 1M tokens $0.75 $0.3 2.5×
輸出 / 1M tokens $3.75 $1.2 3.1×
快取讀取 / 1M tokens $0.075 $0.06 1.3×
快取寫入 - 不額外計費 -

費率取自網站建置時的即時目錄;各模型頁面都列有最新的價目。

兩者的相對位置:每 1M tokens 的輸入價格,涵蓋同一計費單位下全部 76 個聊天模型(對數尺度)

Gemini 3.7 Flash · $0.75 MiniMax M3 · $0.3
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

功能

Gemini 3.7 Flash MiniMax M3
工具使用 是 是
思考控制 是,但供應商未公布調整參數 可設定
結構化輸出 是 -
提示詞快取 隱式 + 顯式 隱式(自動)
快取存活時間 未公布 未公布
最小快取前綴 4096 個 token 512 個 token

規格

Gemini 3.7 Flash MiniMax M3
輸入模態 文字 圖像 音訊 影片 文字 圖像 影片
輸出模態 文字 文字
發布日期 2026-08-13 2026-06-01
知識截止日期 2026-03 -
上下文視窗 1M 1M
最大輸出 66K 524K
思考參數 -
  • thinking.type
  • reasoning_split
可接受的值 -
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
預設值 - adaptive: thinking on, with the model deciding when extra reasoning helps

規格摘錄自各供應商的文件;供應商沒有公布的項目就直接略過,不自行推測。 完整來源: Gemini 3.7 Flash · MiniMax M3

改一行程式碼就能在兩者之間切換

下面每個頁籤都列了這兩個模型 ID,要改的只有醒目標示的那兩行。端點、金鑰和請求格式都不變。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3.7-flash",
    # model="minimax-m3",  # 取消這一行的註解,並把上一行註解掉
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

取得 API 金鑰 →

常見問題

Gemini 3.7 Flash 和 MiniMax M3 哪個比較便宜?

以「輸入 / 1M tokens」來看,MiniMax M3 比較便宜($0.3 對 $0.75,相差 2.5×)。其他項目的結果可能相反,完整價目請看上表;實際成本要看你的用量組合。

可以只串接一次,就對 Gemini 3.7 Flash 和 MiniMax M3 做 A/B 測試嗎?

可以。兩個模型都走同一個 OpenAI 相容端點,用的也是同一把 API 金鑰,切換時只要改一行裡的模型名稱字串。你可以把一部分流量分別導到兩邊,再直接比較帳單。

Gemini 3.7 Flash 與 MiniMax M3 支援提示詞快取嗎?

支援。兩者的快取讀取費率都低於輸入費率,所以前綴已經進快取的工作負載,實際成本會比官網價算出來的低。確切的快取讀取價格請見上方定價表。

相關比較