新規 無料登録、10回の呼び出しを進呈。最大 $1、カード不要。

Gemini 3 Flash

2025-12-17 リリース

chat画像入力コードツール呼び出しリーズニングimageプロンプトキャッシュ

Gemini 3 Flash(プレビュー)は、Google のドキュメントがマルチモーダル理解において世界最高と説明し「これまでで最も強力なエージェント的かつバイブコーディング向けのモデル」と呼ぶモデルで、より大きなモデルに匹敵するフロンティア級の性能をわずかなコストで提供するという約束とともに登場しました。

入力
テキスト 画像 動画 音声 $0.5/M
出力
テキスト $3/M
音声入力
$1/M
キャッシュ読み取り
$0.05/M
コンテキスト
1M
GPT-4o 比
約 90% 割安
知識カットオフ
2025-01

ベンチマーク

平均超え7 / 16
Gemini 3 Flash 測定された他モデル 測定対象の平均 他モデルに上回られていない
ResearchRubrics
36.9%
GPQA Diamond
90.7%
BrowseComp
41.5%
Video-MME (w. sub)
85.2%

ベンダー公表: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

価格の位置づけ

同種 60 モデル中の料金の位置

入力$0.5/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
出力$3/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
キャッシュ読み取り$0.05/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

このバーは、Synthorai 上の同種モデルの中でこのモデルの価格がどこに位置するかを示します。両端には最も安いモデルと最も高いモデルの名前が入ります。表示は基本料金で、バッチ・リージョン・キャッシュ書き込みの割引は料金ページにあります。

スペックと制限

トークン

コンテキストウィンドウ(ベンダー仕様) 1,048,576
最大出力(ベンダー仕様) 65,536
知識カットオフ 2025-01

プロンプトキャッシュ

キャッシュ方式 自動 + 明示
最小プレフィックス 4,096

思考

ベンダー側パラメータ thinkingLevel
指定可能な値 minimal · low · medium · high
デフォルト high リクエストで未指定の場合に適用
無効化の可否 非対応
思考の挙動 Google は Gemini 3 Flash が思考の完全なオフに対応しないと述べており、minimal はスイッチではなく下限であるため、思考トークンはすべてのリクエストで出力トークンとして課金されます。thought signature はそのまま返送すべきで、関数呼び出しでは必須です。
パラメータ reasoning_effort
minimal · low · medium · high ゲートウェイ側のパラメータ面——上のベンダーマッピングが適用されます

モデル

モダリティ テキスト + 画像 + 動画 + 音声 → テキスト
  • プレビューモデル。
  • 入力 1,048,576 トークン。
  • コンピュータ操作に対応。
  • ゲートウェイの機能タグにかかわらず、画像生成は非対応です。

出典:Google 公式ドキュメント ↗

30 秒で Gemini 3 Flash を使う

OpenAI 互換。base_url を差し替えるだけで、SDK はそのまま。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gemini-3-flash-preview",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

Gemini 3 Flash について

  • テキスト・画像・動画・音声・PDF の入力を 1,048,576 トークンのコンテキストウィンドウで受け付け、最大 65,536 出力トークンを生成します。
  • 機能には関数呼び出し、構造化出力、コード実行、コンピュータ使用、検索と Maps のグラウンディング、URL コンテキスト、ファイル検索、コンテキストキャッシュ、Batch API、Flex および Priority の推論が含まれます。
  • 思考は thinking_level で制御し、minimal、low、medium、high を受け付けて既定は high で、これはファミリーで最も高コストな既定です。
  • Gemini 3 のすべてのモデルで minimal はオフのスイッチではなく下限であるため、思考トークンはリクエストごとに課金されます。
  • この世代はまた、マルチターンの継続性を保つために返送しなければならない内部推論の暗号化された痕跡である thought signatures と、新しいメディア解像度の制御を導入しました。
  • いずれも 2.5 から移行する際にはオプションの追加要素ではなく移行作業になります。
  • プレビューチャネルであるため安定性の保証はありません。
  • Google の安定した後継は gemini-3.5-flash で、そのモデルページはこの ID をプレビューのエイリアスとして掲載しています。
  • Synthorai は統一された OpenAI 互換 chat completions インターフェース経由で提供します。

よくある質問

Gemini 3 Flash API は無料で試せますか?

はい。新規アカウントには 10 回のトライアル呼び出しと最大 $1 の無料クレジットが付与され、カード登録は不要です。入力 $0.5/M で計算すると、このクレジットだけで Gemini 3 Flash に対して約 250 回の ~8K トークンのリクエストを送れます。

Gemini 3 Flash は何が得意ですか?

マルチモーダル理解に最良と説明、クリエイティブコーディングの強さを伴う最先端の推論、コンピュータ使用と Maps グラウンディングに対応。全体像はベンダー公式のリリースノートに基づく「このモデルについて」セクションをご覧ください。

Gemini 3 Flash の料金はいくらですか?

Synthorai 上の Gemini 3 Flash は入力 100 万トークンあたり $0.5、出力 100 万トークンあたり $3 です。ベンダー定価のままで、プラットフォーム手数料はありません。キャッシュ済み入力トークンは $0.05/M で課金されます。

Gemini 3 Flash はプロンプトキャッシュに対応していますか?

はい。自動キャッシュがデフォルトで有効なうえ、確実な割引を得られる明示モードもあります。キャッシュ済み入力トークンは $0.05/M(未キャッシュは $0.5/M)で課金されます。なお、キャッシュには 4,096 トークン以上の安定したプレフィックスが必要です。 プロンプトキャッシュガイド →

Gemini 3 Flash を利用するには?

お使いの OpenAI SDK の base_url を "https://synthorai.io/v1" に向け、model="gemini-3-flash-preview" を設定すれば完了です。API キー 1 本でゲートウェイ上のすべてのモデルを利用できます。

Gemini 3 Flash の知識カットオフはいつですか?

ベンダー公式ドキュメントによると、Gemini 3 Flash の知識カットオフは 2025-01 です(2026-07-09 時点)。

関連モデル

比較

このページの値はすべてベンダー自身のドキュメント(上部にリンク)から転記し、確認した日付を付しています。価格はカタログ全体で比較しますが、ベンダーごとに定義が異なる仕様値は差異を明記するにとどめ、図表で比較はしません。当社が測定した数値はなく、スコアも付けていません。

API キーを取得 コストを比較する →