新規 無料登録、10回の呼び出しを進呈。最大 $1、カード不要。

Qwen3 VL Plus

2025-09-23 リリース

chat画像入力リーズニングツール呼び出しプロンプトキャッシュ

Qwen3-VL Plus は Qwen3-VL 視覚言語シリーズの高性能ティアで、画像や動画中心のワークロードに向けて 256K トークンのコンテキストを提供します。

入力
テキスト 画像 動画 $0.2/M
出力
テキスト $1.6/M
キャッシュ読み取り
$0.143/M
コンテキスト
256K
GPT-4o 比
約 96% 割安

価格の位置づけ

同種 60 モデル中の料金の位置

入力$0.2/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
出力$1.6/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
キャッシュ読み取り$0.143/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

このバーは、Synthorai 上の同種モデルの中でこのモデルの価格がどこに位置するかを示します。両端には最も安いモデルと最も高いモデルの名前が入ります。表示は基本料金で、バッチ・リージョン・キャッシュ書き込みの割引は料金ページにあります。

スペックと制限

トークン

コンテキストウィンドウ(ベンダー仕様) 262,144
最大出力(ベンダー仕様) 32,768

プロンプトキャッシュ

キャッシュ方式 自動 + 明示
最小プレフィックス 1,024
保持時間 明示的モード: 5 分、ヒット時にリセット
書き込みコスト 1.25x

思考

ベンダー側パラメータ enable_thinking + thinking_budget
指定可能な値 enable_thinking true · false; thinking_budget in tokens
デフォルト オフ。qwen3-vl-plus および qwen3-vl-flash シリーズでは enable_thinking のデフォルトは false です リクエストで未指定の場合に適用
無効化の可否 対応
思考の挙動 トレースは reasoning_content で返ります。バジェットを超えると推論は打ち切られ、モデルはすぐに回答します。preserve_thinking の対象モデルリストには含まれていません。
パラメータ reasoning_effort
minimal · low · medium · high ゲートウェイ側のパラメータ面——上のベンダーマッピングが適用されます

モデル

モダリティ テキスト + 画像 + 動画 → テキスト
  • ハイブリッド思考を備えたフラッグシップの Qwen3-VL 視覚理解モデル。
  • ビジュアルエージェント(GUI 操作)能力が公式に謳われています。
  • 動画入力は最大 1 時間 / 2GB。

出典:Alibaba 公式ドキュメント ↗

30 秒で Qwen3 VL Plus を使う

OpenAI 互換。base_url を差し替えるだけで、SDK はそのまま。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="qwen3-vl-plus",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Qwen3 VL Plus について

  • 公式ドキュメントは、単一および複数画像の入力、サンプリング調整可能な動画フレーム理解、視覚的質問応答、2D および 3D の物体検出と位置特定、そして構造化された HTML または Markdown へのドキュメント解析への対応を説明しています。
  • Flash 兄弟と同様、応答前に熟考できるハイブリッド思考モデルで、enable_thinking(後の Qwen3.5 以降の世代とは異なり、ここでは既定はオフ)と thinking_budget で消費量に上限を設け、トレースは回答に混ぜられるのではなく reasoning_content で別途返ります。
  • Alibaba 自身の一覧で Plus を際立たせているのはビジュアルエージェント能力です。
  • 共有されるグラウンディング、OCR、ドキュメント解析の機能に加えて、GUI 操作と非常に長い動画の理解について文書化されているのはこのティアであり、Alibaba は 3D の位置特定と Markdown でのドキュメント解析を Qwen3-VL 世代が前世代に加えた点として挙げています。
  • 提供される許容量は最大 32,768 出力トークンに大きな別枠の推論許容量を加えたもので、動画は最大 1 時間・2 GB まで、画像は固定の枚数ではなくトークン上限で制限されます。
  • フレームのサンプリングは自分で設定でき、抽出済みのフレームを渡すこともできます。
  • ツール呼び出し、構造化出力、バッチ推論、明示的および暗黙的なコンテキストキャッシュが掲載されています。
  • ホスト型モデルはオープンウェイトのリリースではなく商用サービスです。
  • Synthorai では OpenAI 互換インターフェース経由で API 呼び出し 1 回で利用できます。

よくある質問

Qwen3 VL Plus API は無料で試せますか?

はい。新規アカウントには 10 回のトライアル呼び出しと最大 $1 の無料クレジットが付与され、カード登録は不要です。入力 $0.2/M で計算すると、このクレジットだけで Qwen3 VL Plus に対して約 625 回の ~8K トークンのリクエストを送れます。

Qwen3 VL Plus は何が得意ですか?

サンプリング調整可能な動画理解、2D および 3D の物体検出、画像・動画中心の作業向け 256K コンテキスト。全体像はベンダー公式のリリースノートに基づく「このモデルについて」セクションをご覧ください。

Qwen3 VL Plus の料金はいくらですか?

Synthorai 上の Qwen3 VL Plus は入力 100 万トークンあたり $0.2、出力 100 万トークンあたり $1.6 です。ベンダー定価のままで、プラットフォーム手数料はありません。キャッシュ済み入力トークンは $0.143/M で課金されます。

Qwen3 VL Plus はプロンプトキャッシュに対応していますか?

はい。自動キャッシュがデフォルトで有効なうえ、確実な割引を得られる明示モードもあります。キャッシュ済み入力トークンは $0.143/M(未キャッシュは $0.2/M)で課金されます。なお、キャッシュには 1,024 トークン以上の安定したプレフィックスが必要です(TTL 明示的モード: 5 分、ヒット時にリセット)。 プロンプトキャッシュガイド →

Qwen3 VL Plus を利用するには?

お使いの OpenAI SDK の base_url を "https://synthorai.io/v1" に向け、model="qwen3-vl-plus" を設定すれば完了です。API キー 1 本でゲートウェイ上のすべてのモデルを利用できます。

関連モデル

比較

このページの値はすべてベンダー自身のドキュメント(上部にリンク)から転記し、確認した日付を付しています。価格はカタログ全体で比較しますが、ベンダーごとに定義が異なる仕様値は差異を明記するにとどめ、図表で比較はしません。当社が測定した数値はなく、スコアも付けていません。

API キーを取得 コストを比較する →