DeepSeek V4 Flash (0731)
厂商牌价,无平台加价,按量付费。 以下为官方 list 价。登录客户可在 /console/pricing 查看含工作空间折扣的实际价格。 按 70% 缓存命中率计算的等效输入价:$0.088/M. 自动磁盘 KV 前缀缓存:缓存命中按折扣后的缓存读取费率计费,无需开启,也没有写入费。
30 秒用上 DeepSeek V4 Flash (0731)
OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "deepseek-v4-flash-0731",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-0731",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "deepseek-v4-flash-0731",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("deepseek-v4-flash-0731")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));规格与限制
Token
- 上下文窗口(厂商规格)
- 1,000,000
- 最大输出(厂商规格)
- 393,216
提示词缓存
- 缓存方式
- 自动
思考
- 取值
- minimal · low · medium · high 具体接受哪些由厂商决定
模型
- 模态
- 文本 → 文本
- 参数量
- 总参数 284B · 激活 13B MoE
- 许可证
- MIT
- July 2026 release of DeepSeek V4 Flash
- same 284B/13B-active MoE design, gains from a stronger post-training pipeline rather than a new architecture
关于 DeepSeek V4 Flash (0731)
DeepSeek V4 Flash 0731 是 DeepSeek 快速、经济的 V4 Flash 系列在 2026 年 7 月的发布版本,它是此前 V4 Flash 的接替版,而不是并列的一个变体。
- 架构与规模没有变化——混合专家模型,总参数 284B、推理时激活 13B——DeepSeek 把提升归因于大幅增强的后训练流程而非新设计,重点放在智能体工作流与推理质量上。
- 使这一系列在工程上有吸引力的部分全部保留:1M token 上下文窗口、384K 最大输出、MIT 许可权重、函数调用、结构化输出与流式。
- 思考默认开启,轨迹回传在 reasoning_content 中,这一点在它身上比多数模型更要紧:短提示下思维轨迹可能占到输出 token 的绝大部分,于是过紧的 max_tokens 预算会返回空回答,而思考所花的 token 照样计费。
- 接入延迟敏感的链路之前,请为此留出预算或调低推理力度。
- 该模型输入输出均为纯文本,不支持图像输入,需要视觉能力时应搭配视觉模型,而不是直接发多模态消息。
- 由于带日期的发布版与不带日期的滚动名都可调用,需要行为可复现时请固定带日期的 id,并预期不带日期的名字会随时间前移。
- Synthorai 通过 OpenAI 兼容的 chat completions 端点提供该模型。
常见问题
DeepSeek V4 Flash (0731) API 可以免费试用吗?
可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $0.2/M 计算,仅这笔额度就足够对 DeepSeek V4 Flash (0731) 发起约 625 次 ~8K token 的请求。
DeepSeek V4 Flash (0731) 最擅长什么?
284B MoE,激活 13B,MIT 许可、接替此前的 V4 Flash 版本、1M 上下文,最大输出 384K。完整能力请见「关于」部分,内容取自厂商官方发布说明。
DeepSeek V4 Flash (0731) 的价格是多少?
在 Synthorai 上,DeepSeek V4 Flash (0731) 输入 $0.2/百万 token、输出 $0.4/百万 token,即厂商牌价,无平台加价。缓存命中的输入 token 按 $0.04/M 计费。
DeepSeek V4 Flash (0731) 支持提示词缓存(prompt caching)吗?
支持,且全自动:经 DeepSeek 提供的提示词自动缓存,无需改代码。缓存命中的输入 token 按 $0.04/M 计费(未命中 $0.2/M)。 提示词缓存指南 →
如何开通 DeepSeek V4 Flash (0731)?
把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "deepseek-v4-flash-0731" 即可。一把 API key 通用网关上的全部模型。
DeepSeek V4 Flash (0731) 开源吗?
开源:权重以 MIT 许可证 发布。也可以省去 GPU:这里的托管版本按量付费,无需自建基础设施。 运行开源权重模型 →