🎁 新用戶 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Qwen3.8 Max 發布於 2026-08-03

Alibaba chat影像理解程式碼推理工具呼叫長上下文結構化輸出串流輸出提示詞快取
輸入$2/M
輸出$6/M
快取讀取$0.25/M
上下文984K
相較 GPT-4o便宜約 60%

廠商牌價,無平台加價,按用量計費。 以下為官方 list 價。已登入的使用者可在 /console/pricing 查看含工作空間折扣的實際價格。 以 70% 快取命中率計算的等效輸入價:$0.775/M. 隱式上下文快取自動生效;顯式 cache_control 模式提供更深折扣(最小塊 1,024 token,5 分鐘 TTL、命中即重置)。各模型快取讀取價見價格表。

30 秒用上 Qwen3.8 Max

OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

規格與限制

Token

上下文視窗(廠商規格)
983,616
最大輸出(廠商規格)
131,072

提示詞快取

快取方式
自動 + 顯式
存活時間
顯式模式:5 分鐘,命中即重置

思考

取值
minimal · low · medium · high 具體接受哪些由廠商決定

模型

模態
文字 + 影像 → 文字
參數量
總參數 2.4T MoE
  • Flagship Qwen3.8 Max: natively vision-language, 2.4T-parameter MoE
  • thinking trace returned in reasoning_content
  • text and image in, text out

依據 Alibaba 官方文件 ↗

關於 Qwen3.8 Max

2.4 兆參數 MoE,原生視覺語言
文字與圖像輸入,輸出最高 131K
按快取分檔計價,利好提示密集型迴圈

Qwen3.8 Max 是阿里巴巴於 2026 年 8 月 3 日發布的通義千問旗艦模型。

  • 官方描述稱它是原生視覺語言的 Max 模型,採用混合專家(MoE)架構、參數規模 2.4 兆,是千問系列迄今能力最強的模型。
  • 它接受文字和圖像輸入並回傳文字,因此一次請求就能把提示詞與截圖、圖表或掃描件放在一起,不必再把圖像繞到另一個視覺模型上。
  • 思考是預設行為的一部分:模型會在 reasoning_content 欄位裡單獨回傳思維軌跡,這意味著即便回答很短也會消耗推理 token,把 max_tokens 設得很小時可能出現請求成功但回答為空的情況。
  • 函式呼叫、嚴格 JSON schema 結構化輸出、以及在末幀帶 usage 的串流都可用,接進既有的 OpenAI 相容整合無需特殊處理。
  • 上下文接近一百萬 token,單次回應最高 131,072 token,是上一代 Max 輸出上限的兩倍,這也是把長文生成遷到它上面最具體的理由。
  • 計價按快取行為分檔而非按上下文長度:標準輸入價、自動快取命中的更低價,以及顯式建立與讀取快取各自獨立的價格,因此複用穩定前綴的智慧體迴圈能實質受益。
  • 阿里列出的可用區域為北京與新加坡。
  • Synthorai 透過 OpenAI 相容的 chat completions 端點提供該模型。

常見問題

Qwen3.8 Max API 可以免費試用嗎?

可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $2/M 計算,光是這筆額度就足以對 Qwen3.8 Max 發出約 62 次 ~8K token 的請求。

Qwen3.8 Max 最擅長什麼?

2.4 兆參數 MoE,原生視覺語言、文字與圖像輸入,輸出最高 131K、按快取分檔計價,利好提示密集型迴圈。完整能力請見「關於」一節,內容取自廠商官方發布說明。

Qwen3.8 Max 的價格是多少?

在 Synthorai 上,Qwen3.8 Max 輸入 $2/百萬 token、輸出 $6/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.25/M 計費。

Qwen3.8 Max 支援提示詞快取(prompt caching)嗎?

支援:自動快取預設開啟,另有顯式模式可獲得確定的折扣。快取命中的輸入 token 以 $0.25/M 計費(未命中 $2/M)(TTL 顯式模式:5 分鐘,命中即重置)。 提示詞快取指南 →

如何開通 Qwen3.8 Max?

把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "qwen3.8-max" 即可。一組 API key 通用閘道上的所有模型。

相關模型

免費取得 API key 算算你的成本 →