DeepSeek V4 Flash (0731)
廠商牌價,無平台加價,按用量計費。 以下為官方 list 價。已登入的使用者可在 /console/pricing 查看含工作空間折扣的實際價格。 以 70% 快取命中率計算的等效輸入價:$0.088/M. 自動磁碟 KV 前綴快取:快取命中按折扣後的快取讀取費率計費,無需開啟,也沒有寫入費。
30 秒用上 DeepSeek V4 Flash (0731)
OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "deepseek-v4-flash-0731",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-0731",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "deepseek-v4-flash-0731",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("deepseek-v4-flash-0731")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));規格與限制
Token
- 上下文視窗(廠商規格)
- 1,000,000
- 最大輸出(廠商規格)
- 393,216
提示詞快取
- 快取方式
- 自動
思考
- 取值
- minimal · low · medium · high 具體接受哪些由廠商決定
模型
- 模態
- 文字 → 文字
- 參數量
- 總參數 284B · 啟用 13B MoE
- 授權條款
- MIT
- July 2026 release of DeepSeek V4 Flash
- same 284B/13B-active MoE design, gains from a stronger post-training pipeline rather than a new architecture
關於 DeepSeek V4 Flash (0731)
DeepSeek V4 Flash 0731 是 DeepSeek 快速、經濟的 V4 Flash 系列在 2026 年 7 月的發布版本,它是先前 V4 Flash 的接替版,而不是並列的一個變體。
- 架構與規模沒有變化——混合專家模型,總參數 284B、推理時啟用 13B——DeepSeek 把提升歸因於大幅增強的後訓練流程而非新設計,重點放在智慧體工作流與推理品質上。
- 使這一系列在工程上具吸引力的部分全部保留:1M token 上下文視窗、384K 最大輸出、MIT 授權權重、函式呼叫、結構化輸出與串流。
- 思考預設開啟,軌跡回傳在 reasoning_content 中,這一點在它身上比多數模型更要緊:短提示下思維軌跡可能占到輸出 token 的絕大部分,於是過緊的 max_tokens 預算會回傳空回答,而思考所花的 token 照樣計費。
- 接入延遲敏感的鏈路之前,請為此留出預算或調低推理力度。
- 該模型輸入輸出均為純文字,不支援圖像輸入,需要視覺能力時應搭配視覺模型,而不是直接發送多模態訊息。
- 由於帶日期的發布版與不帶日期的滾動名都可呼叫,需要行為可重現時請固定帶日期的 id,並預期不帶日期的名字會隨時間前移。
- Synthorai 透過 OpenAI 相容的 chat completions 端點提供該模型。
常見問題
DeepSeek V4 Flash (0731) API 可以免費試用嗎?
可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $0.2/M 計算,光是這筆額度就足以對 DeepSeek V4 Flash (0731) 發出約 625 次 ~8K token 的請求。
DeepSeek V4 Flash (0731) 最擅長什麼?
284B MoE,啟用 13B,MIT 授權、接替先前的 V4 Flash 版本、1M 上下文,最大輸出 384K。完整能力請見「關於」一節,內容取自廠商官方發布說明。
DeepSeek V4 Flash (0731) 的價格是多少?
在 Synthorai 上,DeepSeek V4 Flash (0731) 輸入 $0.2/百萬 token、輸出 $0.4/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.04/M 計費。
DeepSeek V4 Flash (0731) 支援提示詞快取(prompt caching)嗎?
支援,且全自動:由 DeepSeek 供應的提示詞會自動快取,無需改程式碼。快取命中的輸入 token 以 $0.04/M 計費(未命中 $0.2/M)。 提示詞快取指南 →
如何開通 DeepSeek V4 Flash (0731)?
把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "deepseek-v4-flash-0731" 即可。一組 API key 通用閘道上的所有模型。
DeepSeek V4 Flash (0731) 是開源的嗎?
是,權重以 MIT 授權 發布。也可以省下 GPU:這裡的託管版本按用量計費,無需自建基礎設施。 執行開放權重模型 →