新帳號 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

DeepSeek V4 Flash (0731) vs MiniMax M3

MiniMax M3 已從我們的目錄下架。下方是它最後公布的費率;它已經無法呼叫,這組比較裡的另一個模型則仍可呼叫。

vs

什麼情況選哪一個

deepseek-v4-flash-0731 和 minimax-m3 都是純文字輸出模型,擁有 1000000-token 的上下文,其中 minimax-m3 在新 token 上略便宜:每百萬輸入 $0.3、輸出 $1.2,對比 $0.44 和 $1.32。deepseek-v4-flash-0731 在重複使用上保持優勢,快取讀取 $0.044 對比 $0.06,大約低 1.4x,不過其 393216-token 的最大輸出低於 524288 的上限。當您需要圖像或影片輸入、更大的最大輸出或可關閉思考時,請選擇 minimax-m3。對於快取前綴佔帳單大宗的純文字聊天、程式碼與推理工作,請選擇 deepseek-v4-flash-0731。

Benchmark 成績

MiniMax M3:供應商沒有公布 benchmark 成績。

高於平均DeepSeek V4 Flash (0731)10 / 28
DeepSeek V4 Flash (0731) MiniMax M3 其他有成績的模型 其他模型平均 ★ 沒有模型分數更高
SWE-Bench Pro
56%
N/A
Cybergym
76.7%
N/A
JobBench
41.3%
N/A
GPQA Diamond
89.9%
N/A
Agents' Last Exam
25.2%
N/A

供應商公布: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

定價

DeepSeek V4 Flash (0731) MiniMax M3 Δ
輸入 / 1M tokens $0.44 $0.3 1.5×
輸出 / 1M tokens $1.32 $1.2 1.1×
快取讀取 / 1M tokens $0.044 $0.06 0.73×
快取寫入 不額外計費 不額外計費 -

費率取自網站建置時的即時目錄;各模型頁面都列有最新的價目。

兩者的相對位置:每 1M tokens 的輸入價格,涵蓋同一計費單位下全部 76 個聊天模型(對數尺度)

功能

DeepSeek V4 Flash (0731) MiniMax M3
工具使用 是 是
思考控制 是,但供應商未公布調整參數 可設定
結構化輸出 是 -
提示詞快取 隱式(自動) 隱式(自動)
快取存活時間 no fixed TTL (evicted when unused) 未公布
最小快取前綴 未公布 512 個 token

規格

DeepSeek V4 Flash (0731) MiniMax M3
輸入模態 文字 文字 圖像 影片
輸出模態 文字 文字
發布日期 2026-07-31 2026-06-01
上下文視窗 1M 1M
最大輸出 393K 524K
思考參數 -
  • thinking.type
  • reasoning_split
可接受的值 -
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
預設值 - adaptive: thinking on, with the model deciding when extra reasoning helps

規格摘錄自各供應商的文件;供應商沒有公布的項目就直接略過,不自行推測。 完整來源: DeepSeek V4 Flash (0731) · MiniMax M3

改一行程式碼就能在兩者之間切換

下面每個頁籤都列了這兩個模型 ID,要改的只有醒目標示的那兩行。端點、金鑰和請求格式都不變。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    # model="minimax-m3",  # 取消這一行的註解,並把上一行註解掉
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

取得 API 金鑰 →

常見問題

DeepSeek V4 Flash (0731) 和 MiniMax M3 哪個比較便宜?

以「輸入 / 1M tokens」來看,MiniMax M3 比較便宜($0.3 對 $0.44,相差 1.5×)。其他項目的結果可能相反,完整價目請看上表;實際成本要看你的用量組合。

可以只串接一次,就對 DeepSeek V4 Flash (0731) 和 MiniMax M3 做 A/B 測試嗎?

可以。兩個模型都走同一個 OpenAI 相容端點,用的也是同一把 API 金鑰,切換時只要改一行裡的模型名稱字串。你可以把一部分流量分別導到兩邊,再直接比較帳單。

DeepSeek V4 Flash (0731) 與 MiniMax M3 支援提示詞快取嗎?

支援。兩者的快取讀取費率都低於輸入費率,所以前綴已經進快取的工作負載,實際成本會比官網價算出來的低。確切的快取讀取價格請見上方定價表。

相關比較