新用戶 免費註冊,送 10 次呼叫,最高 $1,免綁卡。

gemini-2.5-flash-image

發布於 2025-08-26

image影像理解提示詞快取

Gemini 2.5 Flash Image,即 Nano Banana,是 Google 的影像生成與編輯模型,官方頁面稱它是其面向高速視覺創作的最佳引擎,擁有頂尖的速度和效率。

輸入
文字 影像 $0.3/M
輸出
影像 文字 $30/M
知識截止
2025-06

Benchmark 成績

gemini-2.5-flash-image:公布了 22 項,但沒有一項是足夠多的其他模型也測過的,無法比較。

gemini-2.5-flash-image 其他被測模型 同儕均值 無人分數更高
DreamEval Single-Image Editing Easy, avg
77.8%

廠商公布: Amazon ByteDance

價格在同類中的位置

價格在 8 個同類模型中的位置

輸入$0.3/M
$0.25 · gemini-3.1-flash-lite-image GPT Image 1 · $5
輸出$30/M
$8 · GPT Image 1 Mini Gemini 3 Pro Image (Preview) · $120

這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。

規格與限制

Token

最大輸出(廠商規格) 32,768
知識截止 2025-06

影像

尺寸
  • 1024x1024 (1:1)
  • 832x1248 (2:3)
  • 1248x832 (3:2)
  • 864x1184 (3:4)
  • 1184x864 (4:3)
  • 896x1152 (4:5)
  • 1152x896 (5:4)
  • 768x1344 (9:16)
  • 1344x768 (16:9)
  • 1536x672 (21:9)
輸入方式 文生圖、對話式影像編輯(影像 + 文字輸入)
圖像能力
  • 原生多模態影像生成,支援對話式影像編輯,針對高吞吐、低延遲的創意工作流最佳化
  • 影像與文字輸入,影像與文字輸出

模型

模態 文字 + 影像 → 影像 + 文字

作為影像模型少見地公布了知識截止(2025 年 6 月);不支援函式呼叫與思考。

依據 Google 官方文件 ↗

單一提示詞 — 經由閘道測量

提示詞 A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-2.5-flash-image

gemini-2.5-flash-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

模型回傳 1024×1024 延遲 7 s

單一提示詞,每個模型一次請求,不重試且不擇優挑選——皆為各模型回傳的第一個結果。尺寸與長度皆未強制指定:每個模型均使用其預設值,因為若將請求調整為迎合所有模型,反而無法展現任何一方的優勢。此處的檔案皆已針對網頁重新編碼,因此請評斷其構圖與提示詞遵循度,而非壓縮品質。

30 秒用上 gemini-2.5-flash-image

OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/images/generations

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-2.5-flash-image",
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

關於 gemini-2.5-flash-image

  • 它為高併發場景、對話式影像編輯和低延遲工作流設計,把影像與文字輸入的原生多模態理解和 1K、2K、4K 的圖文輸出結合起來,並在模型正式發布時加入了寬高比控制。
  • 編輯遵循該家族的一貫模式:承接上一輪互動的多輪對話式細化、增刪改元素、用於局部重繪的語義遮罩、風格遷移,以及由多張參考圖合成。
  • token 上限為輸入 65,536、輸出 32,768,支援結構化輸出、快取、批次處理以及 Flex 和 Priority 推理,而函式呼叫、搜尋事實依據和思考則不支援,這也實際限定了它在落筆之前能對版面做多少推理。
  • 每次生成都帶有 SynthID 水印。
  • Google 現在把它描述為 Nano Banana 系列的元老,並建議新專案改用 Nano Banana 2 Lite 以取得更好的品質、更快的速度和更低的成本,因此應該把它當作相容選項而非預設選擇。
  • 它的知識截止為 2025 年 6 月。
  • Synthorai 將它放在與其 chat 模型相同的 OpenAI 相容端點之後。

常見問題

gemini-2.5-flash-image API 可以免費試用嗎?

可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。足以在新增付款方式之前,用真實工作負載試試 gemini-2.5-flash-image。

gemini-2.5-flash-image 最擅長什麼?

高速視覺創作的最佳引擎、低延遲對話式影像編輯、頂尖的速度與效率。完整能力請見「關於」一節,內容取自廠商官方發布說明。

gemini-2.5-flash-image 的價格是多少?

在 Synthorai 上,gemini-2.5-flash-image 輸入 $0.3/百萬 token、輸出 $30/百萬 token,即廠商牌價,無平台加價。

如何呼叫 gemini-2.5-flash-image API 生成圖片?

向 Synthorai 的 /v1/images/generations 發送 POST,model="gemini-2.5-flash-image"。這是標準 OpenAI images API 形式,無需廠商 SDK。支援尺寸:1024x1024 (1:1), 832x1248 (2:3), 1248x832 (3:2), 864x1184 (3:4), 1184x864 (4:3), 896x1152 (4:5), 1152x896 (5:4), 768x1344 (9:16), 1344x768 (16:9), 1536x672 (21:9)。

如何開通 gemini-2.5-flash-image?

把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "gemini-2.5-flash-image" 即可。一組 API key 通用閘道上的所有模型。

相關模型

對比

本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。

取得 API 金鑰 算算你的成本 →