新人 免费注册,送 10 次调用,最高 $1,免绑卡。

gemini-2.5-flash-image

发布于 2025-08-26

image图像理解提示词缓存

Gemini 2.5 Flash Image,也就是 Nano Banana,是 Google 的图像生成与编辑模型,官方页面称它是自家面向高速视觉创作的最佳引擎,具备顶尖的速度和效率。

输入
文本 图像 $0.3/M
输出
图像 文本 $30/M
知识截止
2025-06

Benchmark 成绩

gemini-2.5-flash-image:公布了 22 项,但没有一项是足够多的其他模型也测过的,无法比较。

gemini-2.5-flash-image 其他被测模型 同侪均值 无人分数更高
DreamEval Single-Image Editing Easy, avg
77.8%

厂商公布: Amazon ByteDance

价格在同类中的位置

价格在 8 个同类模型中的位置

输入$0.3/M
$0.25 · gemini-3.1-flash-lite-image GPT Image 1 · $5
输出$30/M
$8 · GPT Image 1 Mini Gemini 3 Pro Image (Preview) · $120

这条线显示该模型的价格,在 Synthorai 上同类模型里处于什么位置。两端标出了最便宜和最贵的那个。这里是基础价,批量、区域和缓存写入的折扣见价格页。

规格与限制

Token

最大输出(厂商规格) 32,768
知识截止 2025-06

图像

尺寸
  • 1024x1024 (1:1)
  • 832x1248 (2:3)
  • 1248x832 (3:2)
  • 864x1184 (3:4)
  • 1184x864 (4:3)
  • 896x1152 (4:5)
  • 1152x896 (5:4)
  • 768x1344 (9:16)
  • 1344x768 (16:9)
  • 1536x672 (21:9)
输入方式 文生图、对话式图像编辑(图像 + 文本输入)
图像能力
  • 原生多模态图像生成,支持对话式图像编辑,针对高吞吐、低延迟的创意工作流优化
  • 图像+文本输入,图像+文本输出

模型

模态 文本 + 图像 → 图像 + 文本

作为图像模型少见地公布了知识截止(2025 年 6 月);不支持函数调用和思考。

依据 Google 官方文档 ↗

单个 Prompt —— 通过网关实测

提示词 A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

gemini-2.5-flash-image

gemini-2.5-flash-image: A weathered enamel diner mug on a steel counter, the words "OPEN 24H" stencilled on the mug in worn paint, low winter sun raking in from the left, shallow depth of field.

模型返回 1024×1024 延迟 7 s

统一提示词,每个模型单次请求,无重试且无择优挑选 —— 均为各模型返回的首个结果。尺寸与时长均未固定:各模型使用自身的默认值,因为试图适配所有模型的请求参数无法展现任何模型的优势。此处文件已为 Web 重新编码,因此请评判构图与提示词遵循度,而非压缩质量。

30 秒用上 gemini-2.5-flash-image

OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/images/generations

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.images.generate(
    model="gemini-2.5-flash-image",
    prompt="a watercolor lighthouse at dawn",
    size="1024x1024",
)
print(resp.data[0].b64_json[:80])

关于 gemini-2.5-flash-image

  • 它面向高并发场景、对话式图像编辑和低延迟工作流,把对图像与文本输入的原生多模态理解与 1K、2K、4K 的图文输出结合起来,并在正式发布时加入了宽高比控制。
  • 编辑遵循该家族的一贯模式:承接上一轮交互的多轮对话式细化、增删或修改元素、用于局部重绘的语义遮罩、风格迁移,以及从多张参考图合成。
  • token 上限为输入 65,536、输出 32,768,支持结构化输出、缓存、批处理以及 Flex 和 Priority 推理;函数调用、搜索事实依据和思考不受支持,这实际上限定了它在落笔之前能对版面做多少推理。
  • 每次生成都带有 SynthID 水印。
  • Google 现在称它为 Nano Banana 系列的元老级旧版模型,并建议新项目改用 Nano Banana 2 Lite 以获得更好的质量、更快的速度和更低的成本,因此应当把它当作兼容选项而不是默认选择。
  • 它的知识截止为 2025 年 6 月。
  • Synthorai 通过与其聊天模型相同的 OpenAI 兼容端点提供它。

常见问题

gemini-2.5-flash-image API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。足够在添加付款方式之前,用真实工作负载试一试 gemini-2.5-flash-image。

gemini-2.5-flash-image 最擅长什么?

高速视觉创作的最佳引擎、低延迟对话式图像编辑、顶尖的速度与效率。完整能力请见「关于」部分,内容取自厂商官方发布说明。

gemini-2.5-flash-image 的价格是多少?

在 Synthorai 上,gemini-2.5-flash-image 输入 $0.3/百万 token、输出 $30/百万 token,即厂商牌价,无平台加价。

如何调用 gemini-2.5-flash-image API 生成图片?

向 Synthorai 的 /v1/images/generations 发送 POST,model="gemini-2.5-flash-image",即标准 OpenAI images API 形态,无需厂商 SDK。支持尺寸:1024x1024 (1:1), 832x1248 (2:3), 1248x832 (3:2), 864x1184 (3:4), 1184x864 (4:3), 896x1152 (4:5), 1152x896 (5:4), 768x1344 (9:16), 1344x768 (16:9), 1536x672 (21:9)。

如何开通 gemini-2.5-flash-image?

把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "gemini-2.5-flash-image" 即可。一把 API key 通用网关上的全部模型。

相关模型

对比

本页每个值都转录自厂商自己的文档(链接见上),并带有核对日期。价格在全目录范围内比较;各厂商定义不同的规格值,只说明差异而不作图表对比。此处没有任何由我们测量的数据,也不做评分。

获取 API 密钥 算算你的成本 →