Gemini 3 Flash(preview)是 Google 文件描述為全球多模態理解最佳的模型,也是它口中「迄今最強的智慧體與 vibe-coding 模型」,發布時的宣稱是以一小部分成本達到可與更大模型比肩的前沿級表現。
- 輸入
- 文字 影像 影片 音訊 $0.5/M
- 輸出
- 文字 $3/M
- 音訊輸入
- $1/M
- 快取讀取
- $0.05/M
- 上下文
- 1M
- 相較 GPT-4o
- 便宜約 90%
- 知識截止
- 2025-01
Benchmark 成績
廠商公布: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai
價格在同類中的位置
價格在 60 個同類模型中的位置
這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。
規格與限制
Token
| 上下文視窗(廠商規格) | 1,048,576 |
|---|---|
| 最大輸出(廠商規格) | 65,536 |
| 知識截止 | 2025-01 |
提示詞快取
| 快取方式 | 自動 + 顯式 |
|---|---|
| 最低前綴 | 4,096 |
思考
| 廠商參數 | thinkingLevel |
|---|---|
| 可選值 | minimal · low · medium · high |
| 預設值 | high 請求未指定時生效 |
| 可關閉 | 不支援 |
| 思考行為 | Google 表示 Gemini 3 Flash 不支援完全關閉思考,因此 minimal 是下限而非開關,每個請求的思考 token 都按輸出 token 計費;thought signature 應原樣回傳,函式呼叫時更是必要。 |
| 參數 | reasoning_effort |
| 取值 | minimal · low · medium · high 閘道側參數面——以上方廠商映射為準 |
模型
| 模態 | 文字 + 影像 + 影片 + 音訊 → 文字 |
|---|
- 預覽模型
- 1,048,576 token 輸入
- 支援 computer use
- 儘管閘道器帶有能力標籤,但不支援影像生成
30 秒用上 Gemini 3 Flash
OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="gemini-3-flash-preview",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "gemini-3-flash-preview",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3-flash-preview",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "gemini-3-flash-preview",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("gemini-3-flash-preview")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));關於 Gemini 3 Flash
- 它在 1,048,576 token 上下文視窗內接受文字、影像、影片、音訊和 PDF 輸入,輸出最高 65,536 token。
- 能力包括函式呼叫、結構化輸出、程式碼執行、電腦使用、搜尋與 Maps 事實依據、URL 上下文、檔案搜尋、上下文快取、Batch API,以及 Flex 和 Priority 推理。
- 思考由 thinking_level 控制,接受 minimal、low、medium 和 high,預設為 high,是該家族中最昂貴的預設值:在每一個 Gemini 3 模型上,minimal 都是下限而非關閉開關,因此每個請求都會計入思考 token。
- 這一代還引入了思考簽名(thought signatures),即內部推理的加密軌跡,必須回傳才能保持多輪連續性;連同新的媒體解析度控制項,兩者在從 2.5 升級時都是必須完成的遷移工作,而不是可選項。
- 作為預覽通道,它不提供穩定性保證;Google 的正式後繼者是 gemini-3.5-flash,其模型頁把這個 ID 列為自己的預覽別名。
- Synthorai 透過其統一的 OpenAI 相容 chat completions 介面提供它。
常見問題
Gemini 3 Flash API 可以免費試用嗎?
可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $0.5/M 計算,光是這筆額度就足以對 Gemini 3 Flash 發出約 250 次 ~8K token 的請求。
Gemini 3 Flash 最擅長什麼?
被稱為多模態理解最佳、頂尖推理與創意編碼實力、支援電腦使用與 Maps 事實依據。完整能力請見「關於」一節,內容取自廠商官方發布說明。
Gemini 3 Flash 的價格是多少?
在 Synthorai 上,Gemini 3 Flash 輸入 $0.5/百萬 token、輸出 $3/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.05/M 計費。
Gemini 3 Flash 支援提示詞快取(prompt caching)嗎?
支援:自動快取預設開啟,另有顯式模式可獲得確定的折扣。快取命中的輸入 token 以 $0.05/M 計費(未命中 $0.5/M);提示詞需有 4,096 個 token 以上的穩定前綴才能命中快取。 提示詞快取指南 →
如何開通 Gemini 3 Flash?
把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "gemini-3-flash-preview" 即可。一組 API key 通用閘道上的所有模型。
Gemini 3 Flash 的知識截止日期是什麼時候?
Gemini 3 Flash 的知識截止日期為 2025-01,依據廠商官方文件(資料核驗於 2026-07-09)。
相關模型
對比
本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。