新用戶 免費註冊,送 10 次呼叫,最高 $1,免綁卡。
此模型已從現行目錄下架,以下資訊為封存內容。

MiniMax M3

發布於 2026-06-01

chat程式碼推理工具呼叫影像理解提示詞快取

MiniMax M3 是 MiniMax 的前沿模型,被定位為首個同時集齊三大前沿能力的開放權重釋出:編碼、智慧體推理與原生多模態理解。

輸入
文字 影像 影片 $0.3/M
輸出
文字 $1.2/M
快取讀取
$0.06/M
上下文
1M
相較 GPT-4o
便宜約 94%

價格在同類中的位置

價格在 60 個同類模型中的位置

輸入$0.3/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
輸出$1.2/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
快取讀取$0.06/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。

規格與限制

Token

上下文視窗(廠商規格) 1,000,000
最大輸出(廠商規格) 524,288

提示詞快取

快取方式 自動
最低前綴 512

思考

廠商參數 thinking.type + reasoning_split
可選值 thinking.type adaptive · disabled; reasoning_split boolean
預設值 自適應:思考開啟,由模型判斷何時需要額外推理 請求未指定時生效
可關閉 支援
思考行為 reasoning_split 只改變軌跡的位置。開啟時,軌跡透過 reasoning_content 與 reasoning_details 回傳;關閉時,它會以 think 標籤包裹留在 content 中,而在工具呼叫的輪次裡,必須把含有它的完整 assistant 訊息回傳。
參數 reasoning_effort
取值 minimal · low · medium · high 閘道側參數面——以上方廠商映射為準

模型

模態 文字 + 影像 + 影片 → 文字
參數量 總參數 428B · 啟用 23B MoE
授權條款 MiniMax Community License
  • MSA 稀疏注意力搭配 1M token 上下文(輸入 512K 以內按標準計費)
  • 約 428B 總參數 / 約 23B 啟用的 MoE
  • 原生多模態(影像與影片輸入)、computer use、自適應思考
  • 輸入達 512 token 以上即自動啟用前綴快取

依據 MiniMax 官方文件 ↗

30 秒用上 MiniMax M3

OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="minimax-m3",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

關於 MiniMax M3

  • 它構建於自研的 MiniMax Sparse Attention(MSA)架構之上,總參數約 428B、啟用約 23B,支援最高 1M token 的上下文視窗並保證至少 512K,瞄準長程智慧體任務與整個程式碼庫層級的理解;MiniMax 表示 MSA 把最大上下文下的每 token 算力降到上一代的二十分之一,而上一代家族的上限遠低於 1M。
  • 不同於外掛式的做法,它的多模態從第零步就參與訓練,以求文字與視覺語義的深度對齊,API 也在文字之外接受影像與影片。
  • 思考由 thinking 物件控制,提供 enabled、adaptive 與 disabled 三種設定,而不是改換另一個模型;另有獨立的 reasoning_split 旗標決定思維鏈是回傳在 reasoning_content 與 reasoning_details 中,還是以 think 標籤包裹留在訊息內。
  • 思考在設計上會與工具呼叫交錯,MiniMax 的工具使用指南要求把回傳的推理欄位保留到下一輪。
  • 前綴快取在輸入超過 512 token 後自動啟用。
  • 權重以 MiniMax Community License 釋出,該授權要求商用產品標註模型出處。
  • Synthorai 透過其 OpenAI 相容端點提供 MiniMax M3。

常見問題

MiniMax M3 API 可以免費試用嗎?

可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $0.3/M 計算,光是這筆額度就足以對 MiniMax M3 發出約 416 次 ~8K token 的請求。

MiniMax M3 最擅長什麼?

首個集編碼、智慧體、多模態的開放權重、最高 1M 上下文,保證 512K、多模態從第零步參與訓練。完整能力請見「關於」一節,內容取自廠商官方發布說明。

MiniMax M3 的價格是多少?

在 Synthorai 上,MiniMax M3 輸入 $0.3/百萬 token、輸出 $1.2/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.06/M 計費。

MiniMax M3 支援提示詞快取(prompt caching)嗎?

支援,且全自動:由 MiniMax 供應的提示詞會自動快取,無需改程式碼。快取命中的輸入 token 以 $0.06/M 計費(未命中 $0.3/M);提示詞需有 512 個 token 以上的穩定前綴才能命中快取。 提示詞快取指南 →

如何開通 MiniMax M3?

把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "minimax-m3" 即可。一組 API key 通用閘道上的所有模型。

MiniMax M3 是開源的嗎?

是,權重以 MiniMax Community License 發布(官方儲存庫連結見「關於」一節)。也可以省下 GPU:這裡的託管版本按用量計費,無需自建基礎設施。 執行開放權重模型 →

相關模型

對比

本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。

取得 API 金鑰 算算你的成本 →