Qwen3-Max 是 Qwen 團隊的兆級參數旗艦,在官方文章「Qwen3-Max: Just Scale」中發表,具備 256K token 上下文。
- 輸入
- 文字 $1.2/M
- 輸出
- 文字 $6/M
- 快取讀取
- $0.359/M
- 上下文
- 256K
- 相較 GPT-4o
- 便宜約 76%
Benchmark 成績
廠商公布: Alibaba (Qwen)
價格在同類中的位置
價格在 60 個同類模型中的位置
這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。
規格與限制
Token
| 上下文視窗(廠商規格) | 256,000 |
|---|---|
| 最大輸出(廠商規格) | 65,536 |
提示詞快取
| 快取方式 | 自動 + 顯式 |
|---|---|
| 最低前綴 | 1,024 |
| 存活時間 | 顯式模式:5 分鐘,命中即重置 |
| 寫入成本 | 1.25x |
思考
| 廠商參數 | enable_thinking + thinking_budget |
|---|---|
| 可選值 | enable_thinking true · false; thinking_budget in tokens |
| 預設值 | 關閉;enable_thinking 預設為 false,thinking_budget 預設為模型的最大思維鏈長度 請求未指定時生效 |
| 可關閉 | 支援 |
| 思考行為 | 思考軌跡透過 reasoning_content 回傳;訊息歷史中的 reasoning_content 預設會被忽略,且 qwen3-max 不在接受 preserve_thinking 的模型之列。 |
| 參數 | reasoning_effort |
| 取值 | minimal · low · medium · high 閘道側參數面——以上方廠商映射為準 |
模型
| 模態 | 文字 → 文字 |
|---|---|
| 參數量 | 總參數 1T+ MoE |
- 首個參數量突破一兆的 Qwen 旗艦(閉源權重),純文字
- 官方定位為智慧體編碼與工具呼叫
- 混合思考,預設關閉
30 秒用上 Qwen3 Max
OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3-max",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3-max",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3-max",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3-max",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3-max")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));關於 Qwen3 Max
- 阿里表示它在自家的知識、推理、編碼、指令遵循、智慧體任務與多語言理解評測中取得最先進的結果,釋出說明還特別點出針對智慧體編碼與工具呼叫的升級。
- 該產品線提供 Instruct 形態,另有整合程式碼直譯器與自適應工具使用的 Thinking 變體,用於更難的推理問題。
- 作為 Qwen3 系列最大的模型,它面向高要求的生產負載。
- 它是文字輸入、文字輸出的模型(視覺能力在 Qwen3-VL 同門上),輸出最高 65,536 token,Model Studio 列出工具呼叫、結構化輸出、批次推理,以及顯式與隱式的上下文快取。
- 有一項行為細節把它與本目錄中後續的每一代 Qwen 區分開來:它是混合思考模型,推理以 enable_thinking 參數切換且預設關閉,而 Qwen3.5 及更新的世代出廠時思考就已開啟。
- 啟用推理後,thinking_budget 參數用來限制花費,推理軌跡另外回傳在 reasoning_content 中,並按輸出計費。
- 這個託管旗艦的權重未公開,阿里現在也把它列為舊版模型,建議新專案改用 Qwen3.5 與 Qwen3.6 系列。
- Synthorai 透過 OpenAI 相容 chat 端點提供它。
常見問題
Qwen3 Max API 可以免費試用嗎?
可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $1.2/M 計算,光是這筆額度就足以對 Qwen3 Max 發出約 104 次 ~8K token 的請求。
Qwen3 Max 最擅長什麼?
萬億參數級旗艦,256K 上下文、Thinking 變體整合程式碼直譯器、自適應工具使用應對難題。完整能力請見「關於」一節,內容取自廠商官方發布說明。
Qwen3 Max 的價格是多少?
在 Synthorai 上,Qwen3 Max 輸入 $1.2/百萬 token、輸出 $6/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.359/M 計費。
Qwen3 Max 支援提示詞快取(prompt caching)嗎?
支援:自動快取預設開啟,另有顯式模式可獲得確定的折扣。快取命中的輸入 token 以 $0.359/M 計費(未命中 $1.2/M);提示詞需有 1,024 個 token 以上的穩定前綴才能命中快取(TTL 顯式模式:5 分鐘,命中即重置)。 提示詞快取指南 →
如何開通 Qwen3 Max?
把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "qwen3-max" 即可。一組 API key 通用閘道上的所有模型。
相關模型
對比
本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。