🎁 新人 免费注册,送 10 次调用,最高 $1,免绑卡。

DeepSeek V4 Flash (0731) 发布于 2026-07-31

DeepSeek chat代码推理工具调用结构化输出流式输出提示词缓存
输入$0.2/M
输出$0.4/M
缓存读取$0.04/M
上下文1M
对比 GPT-4o便宜约 96%

厂商牌价,无平台加价,按量付费。 以下为官方 list 价。登录客户可在 /console/pricing 查看含工作空间折扣的实际价格。 按 70% 缓存命中率计算的等效输入价:$0.088/M. 自动磁盘 KV 前缀缓存:缓存命中按折扣后的缓存读取费率计费,无需开启,也没有写入费。

30 秒用上 DeepSeek V4 Flash (0731)

OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

规格与限制

Token

上下文窗口(厂商规格)
1,000,000
最大输出(厂商规格)
393,216

提示词缓存

缓存方式
自动

思考

取值
minimal · low · medium · high 具体接受哪些由厂商决定

模型

模态
文本 → 文本
参数量
总参数 284B · 激活 13B MoE
许可证
MIT
  • July 2026 release of DeepSeek V4 Flash
  • same 284B/13B-active MoE design, gains from a stronger post-training pipeline rather than a new architecture

依据 DeepSeek 官方文档 ↗

关于 DeepSeek V4 Flash (0731)

284B MoE,激活 13B,MIT 许可
接替此前的 V4 Flash 版本
1M 上下文,最大输出 384K

DeepSeek V4 Flash 0731 是 DeepSeek 快速、经济的 V4 Flash 系列在 2026 年 7 月的发布版本,它是此前 V4 Flash 的接替版,而不是并列的一个变体。

  • 架构与规模没有变化——混合专家模型,总参数 284B、推理时激活 13B——DeepSeek 把提升归因于大幅增强的后训练流程而非新设计,重点放在智能体工作流与推理质量上。
  • 使这一系列在工程上有吸引力的部分全部保留:1M token 上下文窗口、384K 最大输出、MIT 许可权重、函数调用、结构化输出与流式。
  • 思考默认开启,轨迹回传在 reasoning_content 中,这一点在它身上比多数模型更要紧:短提示下思维轨迹可能占到输出 token 的绝大部分,于是过紧的 max_tokens 预算会返回空回答,而思考所花的 token 照样计费。
  • 接入延迟敏感的链路之前,请为此留出预算或调低推理力度。
  • 该模型输入输出均为纯文本,不支持图像输入,需要视觉能力时应搭配视觉模型,而不是直接发多模态消息。
  • 由于带日期的发布版与不带日期的滚动名都可调用,需要行为可复现时请固定带日期的 id,并预期不带日期的名字会随时间前移。
  • Synthorai 通过 OpenAI 兼容的 chat completions 端点提供该模型。

常见问题

DeepSeek V4 Flash (0731) API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $0.2/M 计算,仅这笔额度就足够对 DeepSeek V4 Flash (0731) 发起约 625 次 ~8K token 的请求。

DeepSeek V4 Flash (0731) 最擅长什么?

284B MoE,激活 13B,MIT 许可、接替此前的 V4 Flash 版本、1M 上下文,最大输出 384K。完整能力请见「关于」部分,内容取自厂商官方发布说明。

DeepSeek V4 Flash (0731) 的价格是多少?

在 Synthorai 上,DeepSeek V4 Flash (0731) 输入 $0.2/百万 token、输出 $0.4/百万 token,即厂商牌价,无平台加价。缓存命中的输入 token 按 $0.04/M 计费。

DeepSeek V4 Flash (0731) 支持提示词缓存(prompt caching)吗?

支持,且全自动:经 DeepSeek 提供的提示词自动缓存,无需改代码。缓存命中的输入 token 按 $0.04/M 计费(未命中 $0.2/M)。 提示词缓存指南 →

如何开通 DeepSeek V4 Flash (0731)?

把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "deepseek-v4-flash-0731" 即可。一把 API key 通用网关上的全部模型。

DeepSeek V4 Flash (0731) 开源吗?

开源:权重以 MIT 许可证 发布。也可以省去 GPU:这里的托管版本按量付费,无需自建基础设施。 运行开源权重模型 →

相关模型

免费获取 API key 算算你的成本 →