新用戶 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

Qwen3 VL Plus

發布於 2025-09-23

chat影像理解推理工具呼叫提示詞快取

Qwen3-VL Plus 是 Qwen3-VL 視覺語言系列的高效能等級,為影像與影片密集的負載提供 256K token 上下文。

輸入
文字 影像 影片 $0.2/M
輸出
文字 $1.6/M
快取讀取
$0.143/M
上下文
256K
相較 GPT-4o
便宜約 96%

價格在同類中的位置

價格在 60 個同類模型中的位置

輸入$0.2/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
輸出$1.6/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
快取讀取$0.143/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。

規格與限制

Token

上下文視窗(廠商規格) 262,144
最大輸出(廠商規格) 32,768

提示詞快取

快取方式 自動 + 顯式
最低前綴 1,024
存活時間 顯式模式:5 分鐘,命中即重置
寫入成本 1.25x

思考

廠商參數 enable_thinking + thinking_budget
可選值 enable_thinking true · false; thinking_budget in tokens
預設值 關閉;在 qwen3-vl-plus 與 qwen3-vl-flash 系列上,enable_thinking 預設為 false 請求未指定時生效
可關閉 支援
思考行為 思考軌跡透過 reasoning_content 回傳;超出預算時推理會被截斷,模型隨即作答。不在 preserve_thinking 的模型清單中。
參數 reasoning_effort
取值 minimal · low · medium · high 閘道側參數面——以上方廠商映射為準

模型

模態 文字 + 影像 + 影片 → 文字
  • 旗艦級的 Qwen3-VL 視覺理解模型,具備混合思考
  • 官方宣稱具備視覺智慧體(GUI 操作)能力
  • 影片輸入最長 1 小時 / 最大 2GB

依據 Alibaba 官方文件 ↗

30 秒用上 Qwen3 VL Plus

OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="qwen3-vl-plus",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

關於 Qwen3 VL Plus

  • 官方文件描述它支援單圖與多圖輸入、可調整取樣的影片影格理解、視覺問答、2D 與 3D 的物件偵測與定位,以及把文件解析為結構化的 HTML 或 Markdown。
  • 與 Flash 同門一樣,它是可先斟酌再作答的混合思考模型,以 enable_thinking(此處預設關閉,不同於後來的 Qwen3.5 及更新世代)與 thinking_budget 控制花費上限,推理軌跡另外回傳在 reasoning_content 中,而不是混在答案裡。
  • 在阿里自家的列表中,Plus 的區別在於視覺智慧體能力:它是被記載可操作 GUI 並理解超長影片的等級,此外還有共享的定位、OCR 與文件解析功能;阿里並指出 3D 定位與 Markdown 文件解析是 Qwen3-VL 這一代相對前代新增的能力。
  • 所提供的規格允許最高 32,768 輸出 token,另加一份大額的獨立推理額度,影片最長一小時、最大 2 GB,影像則以 token 上限而非固定張數為界。
  • 影格取樣由你自行設定,也包括提供預先抽好的影格。
  • 工具呼叫、結構化輸出、批次推理,以及顯式與隱式的上下文快取都在列。
  • 託管模型是商業服務,而不是開放權重釋出。
  • 在 Synthorai 上,透過 OpenAI 相容介面一個 API 呼叫即可使用它。

常見問題

Qwen3 VL Plus API 可以免費試用嗎?

可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $0.2/M 計算,光是這筆額度就足以對 Qwen3 VL Plus 發出約 625 次 ~8K token 的請求。

Qwen3 VL Plus 最擅長什麼?

可調取樣的影片理解、2D 與 3D 目標偵測、256K 上下文,勝任影像影片負載。完整能力請見「關於」一節,內容取自廠商官方發布說明。

Qwen3 VL Plus 的價格是多少?

在 Synthorai 上,Qwen3 VL Plus 輸入 $0.2/百萬 token、輸出 $1.6/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.143/M 計費。

Qwen3 VL Plus 支援提示詞快取(prompt caching)嗎?

支援:自動快取預設開啟,另有顯式模式可獲得確定的折扣。快取命中的輸入 token 以 $0.143/M 計費(未命中 $0.2/M);提示詞需有 1,024 個 token 以上的穩定前綴才能命中快取(TTL 顯式模式:5 分鐘,命中即重置)。 提示詞快取指南 →

如何開通 Qwen3 VL Plus?

把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "qwen3-vl-plus" 即可。一組 API key 通用閘道上的所有模型。

相關模型

對比

本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。

取得 API 金鑰 算算你的成本 →