Qwen3.8 Max
廠商牌價,無平台加價,按用量計費。 以下為官方 list 價。已登入的使用者可在 /console/pricing 查看含工作空間折扣的實際價格。 以 70% 快取命中率計算的等效輸入價:$0.775/M. 隱式上下文快取自動生效;顯式 cache_control 模式提供更深折扣(最小塊 1,024 token,5 分鐘 TTL、命中即重置)。各模型快取讀取價見價格表。
30 秒用上 Qwen3.8 Max
OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3.8-max",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-max",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3.8-max",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3.8-max")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));規格與限制
Token
- 上下文視窗(廠商規格)
- 983,616
- 最大輸出(廠商規格)
- 131,072
提示詞快取
- 快取方式
- 自動 + 顯式
- 存活時間
- 顯式模式:5 分鐘,命中即重置
思考
- 取值
- minimal · low · medium · high 具體接受哪些由廠商決定
模型
- 模態
- 文字 + 影像 → 文字
- 參數量
- 總參數 2.4T MoE
- Flagship Qwen3.8 Max: natively vision-language, 2.4T-parameter MoE
- thinking trace returned in reasoning_content
- text and image in, text out
關於 Qwen3.8 Max
Qwen3.8 Max 是阿里巴巴於 2026 年 8 月 3 日發布的通義千問旗艦模型。
- 官方描述稱它是原生視覺語言的 Max 模型,採用混合專家(MoE)架構、參數規模 2.4 兆,是千問系列迄今能力最強的模型。
- 它接受文字和圖像輸入並回傳文字,因此一次請求就能把提示詞與截圖、圖表或掃描件放在一起,不必再把圖像繞到另一個視覺模型上。
- 思考是預設行為的一部分:模型會在 reasoning_content 欄位裡單獨回傳思維軌跡,這意味著即便回答很短也會消耗推理 token,把 max_tokens 設得很小時可能出現請求成功但回答為空的情況。
- 函式呼叫、嚴格 JSON schema 結構化輸出、以及在末幀帶 usage 的串流都可用,接進既有的 OpenAI 相容整合無需特殊處理。
- 上下文接近一百萬 token,單次回應最高 131,072 token,是上一代 Max 輸出上限的兩倍,這也是把長文生成遷到它上面最具體的理由。
- 計價按快取行為分檔而非按上下文長度:標準輸入價、自動快取命中的更低價,以及顯式建立與讀取快取各自獨立的價格,因此複用穩定前綴的智慧體迴圈能實質受益。
- 阿里列出的可用區域為北京與新加坡。
- Synthorai 透過 OpenAI 相容的 chat completions 端點提供該模型。
常見問題
Qwen3.8 Max API 可以免費試用嗎?
可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $2/M 計算,光是這筆額度就足以對 Qwen3.8 Max 發出約 62 次 ~8K token 的請求。
Qwen3.8 Max 最擅長什麼?
2.4 兆參數 MoE,原生視覺語言、文字與圖像輸入,輸出最高 131K、按快取分檔計價,利好提示密集型迴圈。完整能力請見「關於」一節,內容取自廠商官方發布說明。
Qwen3.8 Max 的價格是多少?
在 Synthorai 上,Qwen3.8 Max 輸入 $2/百萬 token、輸出 $6/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.25/M 計費。
Qwen3.8 Max 支援提示詞快取(prompt caching)嗎?
支援:自動快取預設開啟,另有顯式模式可獲得確定的折扣。快取命中的輸入 token 以 $0.25/M 計費(未命中 $2/M)(TTL 顯式模式:5 分鐘,命中即重置)。 提示詞快取指南 →
如何開通 Qwen3.8 Max?
把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "qwen3.8-max" 即可。一組 API key 通用閘道上的所有模型。