新人 免费注册,送 10 次调用,最高 $1,免绑卡。

GPT-5.4 Mini

发布于 2026-03-16

chat图像理解代码工具调用推理提示词缓存

GPT-5.4 Mini 是 OpenAI「迄今在编码、computer use 和子智能体上最强的 mini 模型」,把 GPT-5.4 的长处带到更快、更高效的档位。

输入
文本 图像 $0.75/M
输出
文本 $4.5/M
缓存读取
$0.375/M
上下文
400K
对比 GPT-4o
便宜约 85%
知识截止
2025-08

Benchmark 成绩

高于同侪均值2 / 10
GPT-5.4 Mini 其他被测模型 同侪均值 无人分数更高
SWE-Bench Pro
54.4%
OSWorld-Verified
72.1%
GDPval-AA v2 Elo · 642-1861
1171
GPQA Diamond
88%
CharXiv (RQ) no tools
80.3%

厂商公布: Alibaba (Qwen) Anthropic ByteDance Google MiniMax Moonshot OpenAI Tencent Z.ai

价格在同类中的位置

价格在 60 个同类模型中的位置

输入$0.75/M
$0.05 · Qwen3 VL Flash GPT-5.4 Pro · $30
输出$4.5/M
$0.275 · DeepSeek V4 Flash GPT-5.4 Pro · $180
缓存读取$0.375/M
$0.0028 · DeepSeek V4 Flash GPT-5.4 Pro · $15

这条线显示该模型的价格,在 Synthorai 上同类模型里处于什么位置。两端标出了最便宜和最贵的那个。这里是基础价,批量、区域和缓存写入的折扣见价格页。

规格与限制

Token

上下文窗口(厂商规格) 400,000
最大输出(厂商规格) 128,000
知识截止 2025-08

提示词缓存

缓存方式 自动
最低前缀 1,024
存活时间 5–10 分钟,最长 1 小时

思考

厂商参数 reasoning.effort
可选值 none · low · medium · high · xhigh
默认值 none 请求未指定时生效
可关闭 支持
参数 reasoning_effort
取值 minimal · low · medium · high 网关侧参数面——以上方厂商映射为准

模型

模态 文本 + 图像 → 文本
  • 定位为编码、computer use 和子智能体场景中最强的 mini 模型
  • 400k 上下文 / 128k 最大输出

依据 OpenAI 官方文档 ↗

30 秒用上 GPT-5.4 Mini

OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="gpt-5.4-mini",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

关于 GPT-5.4 Mini

  • 它提供 400K token 上下文窗口、128K 最大输出 token、图像输入,并完整支持流式、函数调用和结构化输出,价格只是旗舰的一小部分。
  • OpenAI 的发布说明把它描述为面向大批量负载、把 GPT-5.4 级能力带入更快更高效模型的产品,并点名编码、computer use 和子智能体编排是它调优的目标负载。
  • 对智能体开发者尤为关键的是,它保留了旗舰完整的工具列表(函数调用、网页搜索、文件搜索、工具搜索、图像生成、代码解释器、托管 shell、apply patch、skills、computer use 和 MCP),这正是它与更便宜的 nano 档之间的分界线。
  • 推理力度覆盖 none、low、medium、high 和 xhigh,默认 none,长会话还支持压缩(compaction)。
  • 400K 窗口内文档记录的输入上限为 272K token,知识截止为 2025 年 8 月。
  • 上游可用 Chat Completions、Responses 和 Batch,并支持提示词缓存及其折扣缓存输入价,发布快照日期为 2026 年 3 月。
  • 由于它的窗口止于 400K,永远不会越过为 1M 级模型重新定价的长上下文计费阈值,因此提示词变长时成本保持线性。
  • 在 Synthorai 上,发往 GPT-5.4 Mini 的请求与任何 GPT 模型走同一个 OpenAI 兼容端点。

常见问题

GPT-5.4 Mini API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $0.75/M 计算,仅这笔额度就足够对 GPT-5.4 Mini 发起约 166 次 ~8K token 的请求。

GPT-5.4 Mini 最擅长什么?

编码与子智能体的最强 mini、价格只是旗舰的一小部分、400K 上下文,128K 输出。完整能力请见「关于」部分,内容取自厂商官方发布说明。

GPT-5.4 Mini 的价格是多少?

在 Synthorai 上,GPT-5.4 Mini 输入 $0.75/百万 token、输出 $4.5/百万 token,即厂商牌价,无平台加价。缓存命中的输入 token 按 $0.375/M 计费。

GPT-5.4 Mini 支持提示词缓存(prompt caching)吗?

支持,且全自动:经 OpenAI 提供的提示词自动缓存,无需改代码。缓存命中的输入 token 按 $0.375/M 计费(未命中 $0.75/M);提示词需有 1,024 token 以上的稳定前缀才能命中缓存(TTL 5–10 分钟,最长 1 小时)。 提示词缓存指南 →

如何开通 GPT-5.4 Mini?

把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "gpt-5.4-mini" 即可。一把 API key 通用网关上的全部模型。

GPT-5.4 Mini 的知识截止日期是什么时候?

GPT-5.4 Mini 的知识截止日期为 2025-08,依据厂商官方文档(数据核验于 2026-07-09)。

相关模型

对比

本页每个值都转录自厂商自己的文档(链接见上),并带有核对日期。价格在全目录范围内比较;各厂商定义不同的规格值,只说明差异而不作图表对比。此处没有任何由我们测量的数据,也不做评分。

获取 API 密钥 算算你的成本 →