新用戶 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Qwen3 Max

發布於 2025-09-23

chat程式碼推理工具呼叫提示詞快取

Qwen3-Max 是 Qwen 團隊的兆級參數旗艦,在官方文章「Qwen3-Max: Just Scale」中發表,具備 256K token 上下文。

輸入
文字 $1.2/M
輸出
文字 $6/M
快取讀取
$0.359/M
上下文
256K
相較 GPT-4o
便宜約 76%

Benchmark 成績

Qwen3 Max
LiveCodeBench Instruct, v6 (25.02-25.05) 據 Alibaba (Qwen) 公布
沒有其他模型的公開成績
69%
SWE-bench Verified Instruct 據 Alibaba (Qwen) 公布
沒有其他模型的公開成績
69.6%
AIME 2025 Instruct 據 Alibaba (Qwen) 公布
沒有其他模型的公開成績
81.6%
SuperGPQA Instruct 據 Alibaba (Qwen) 公布
沒有其他模型的公開成績
65.1%
τ²-Bench Instruct, weighted 據 Alibaba (Qwen) 公布
沒有其他模型的公開成績
74.8%

廠商公布: Alibaba (Qwen)

價格在同類中的位置

價格在 60 個同類模型中的位置

輸入$1.2/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
輸出$6/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
快取讀取$0.359/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。

規格與限制

Token

上下文視窗(廠商規格) 256,000
最大輸出(廠商規格) 65,536

提示詞快取

快取方式 自動 + 顯式
最低前綴 1,024
存活時間 顯式模式:5 分鐘,命中即重置
寫入成本 1.25x

思考

廠商參數 enable_thinking + thinking_budget
可選值 enable_thinking true · false; thinking_budget in tokens
預設值 關閉;enable_thinking 預設為 false,thinking_budget 預設為模型的最大思維鏈長度 請求未指定時生效
可關閉 支援
思考行為 思考軌跡透過 reasoning_content 回傳;訊息歷史中的 reasoning_content 預設會被忽略,且 qwen3-max 不在接受 preserve_thinking 的模型之列。
參數 reasoning_effort
取值 minimal · low · medium · high 閘道側參數面——以上方廠商映射為準

模型

模態 文字 → 文字
參數量 總參數 1T+ MoE
  • 首個參數量突破一兆的 Qwen 旗艦(閉源權重),純文字
  • 官方定位為智慧體編碼與工具呼叫
  • 混合思考,預設關閉

依據 Alibaba 官方文件 ↗

30 秒用上 Qwen3 Max

OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="qwen3-max",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

關於 Qwen3 Max

  • 阿里表示它在自家的知識、推理、編碼、指令遵循、智慧體任務與多語言理解評測中取得最先進的結果,釋出說明還特別點出針對智慧體編碼與工具呼叫的升級。
  • 該產品線提供 Instruct 形態,另有整合程式碼直譯器與自適應工具使用的 Thinking 變體,用於更難的推理問題。
  • 作為 Qwen3 系列最大的模型,它面向高要求的生產負載。
  • 它是文字輸入、文字輸出的模型(視覺能力在 Qwen3-VL 同門上),輸出最高 65,536 token,Model Studio 列出工具呼叫、結構化輸出、批次推理,以及顯式與隱式的上下文快取。
  • 有一項行為細節把它與本目錄中後續的每一代 Qwen 區分開來:它是混合思考模型,推理以 enable_thinking 參數切換且預設關閉,而 Qwen3.5 及更新的世代出廠時思考就已開啟。
  • 啟用推理後,thinking_budget 參數用來限制花費,推理軌跡另外回傳在 reasoning_content 中,並按輸出計費。
  • 這個託管旗艦的權重未公開,阿里現在也把它列為舊版模型,建議新專案改用 Qwen3.5 與 Qwen3.6 系列。
  • Synthorai 透過 OpenAI 相容 chat 端點提供它。

常見問題

Qwen3 Max API 可以免費試用嗎?

可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $1.2/M 計算,光是這筆額度就足以對 Qwen3 Max 發出約 104 次 ~8K token 的請求。

Qwen3 Max 最擅長什麼?

萬億參數級旗艦,256K 上下文、Thinking 變體整合程式碼直譯器、自適應工具使用應對難題。完整能力請見「關於」一節,內容取自廠商官方發布說明。

Qwen3 Max 的價格是多少?

在 Synthorai 上,Qwen3 Max 輸入 $1.2/百萬 token、輸出 $6/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.359/M 計費。

Qwen3 Max 支援提示詞快取(prompt caching)嗎?

支援:自動快取預設開啟,另有顯式模式可獲得確定的折扣。快取命中的輸入 token 以 $0.359/M 計費(未命中 $1.2/M);提示詞需有 1,024 個 token 以上的穩定前綴才能命中快取(TTL 顯式模式:5 分鐘,命中即重置)。 提示詞快取指南 →

如何開通 Qwen3 Max?

把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "qwen3-max" 即可。一組 API key 通用閘道上的所有模型。

相關模型

對比

本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。

取得 API 金鑰 算算你的成本 →