DeepSeek V4 Flash (0731)
ベンダー定価。プラットフォーム手数料なし、従量課金。 これらは公式 list 価格です。ログイン中のお客様は /console/pricing でワークスペース割引を含む実効価格を確認できます。 キャッシュヒット率 70% 時の実効入力単価:$0.088/M. ディスク KV プレフィックスキャッシュが自動で働きます。キャッシュヒットはオプトインなし・書き込み手数料なしで割引されるキャッシュ読み取り料率で課金されます。
30 秒で DeepSeek V4 Flash (0731) を使う
OpenAI 互換。base_url を差し替えるだけで、SDK はそのまま。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="deepseek-v4-flash-0731",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "deepseek-v4-flash-0731",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-v4-flash-0731",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "deepseek-v4-flash-0731",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("deepseek-v4-flash-0731")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));スペックと制限
トークン
- コンテキストウィンドウ(ベンダー仕様)
- 1,000,000
- 最大出力(ベンダー仕様)
- 393,216
プロンプトキャッシュ
- キャッシュ方式
- 自動
思考
- パラメータ
- reasoning_effort
- 値
- minimal · low · medium · high 受け付ける範囲はプロバイダー次第
モデル
- モダリティ
- テキスト → テキスト
- パラメータ数
- 合計 284B · アクティブ 13B MoE
- ライセンス
- MIT
- July 2026 release of DeepSeek V4 Flash
- same 284B/13B-active MoE design, gains from a stronger post-training pipeline rather than a new architecture
DeepSeek V4 Flash (0731) について
DeepSeek V4 Flash 0731 は、DeepSeek の高速かつ経済的な V4 Flash 系列の 2026 年 7 月リリースであり、従来の V4 Flash と並列のバリアントではなく、その後継にあたります。
- アーキテクチャと規模は変わらず、総パラメータ 284B・推論時に 13B を活性化する Mixture-of-Experts で、DeepSeek は改善の要因を新しい設計ではなく大幅に強化された事後学習パイプラインに帰し、エージェント的なワークフローと推論品質に注力したと説明しています。
- この系列を運用面で魅力的にしていた要素はすべて引き継がれます。
- 100 万トークンのコンテキストウィンドウ、384K の最大出力、MIT ライセンスの重み、関数呼び出し、構造化出力、ストリーミングです。
- 思考は既定で有効でトレースは reasoning_content に返りますが、この点は多くのモデル以上に重要です。
- 短いプロンプトでは推論トレースが出力トークンの大半を占めることがあり、max_tokens の予算が厳しいと本文が空のまま返る一方、思考に使ったトークンは課金されます。
- レイテンシに敏感な経路へ組み込む前に、その分を見込むか推論の強度を下げてください。
- 入出力ともテキストのみで画像入力には対応しないため、視覚が必要な場合はマルチモーダルなメッセージを送るのではなく視覚モデルと併用してください。
- 日付付きのリリースと日付なしのローリング名の双方が呼び出せるため、再現性が要る場合は日付付き id を固定し、日付なしの名前は時間とともに前進すると想定してください。
- Synthorai は OpenAI 互換の chat completions エンドポイント経由で提供します。
よくある質問
DeepSeek V4 Flash (0731) API は無料で試せますか?
はい。新規アカウントには 10 回のトライアル呼び出しと最大 $1 の無料クレジットが付与され、カード登録は不要です。入力 $0.2/M で計算すると、このクレジットだけで DeepSeek V4 Flash (0731) に対して約 625 回の ~8K トークンのリクエストを送れます。
DeepSeek V4 Flash (0731) は何が得意ですか?
284B MoE、13B 活性化、MIT ライセンス、従来の V4 Flash の後継、100 万コンテキストと 384K 最大出力。全体像はベンダー公式のリリースノートに基づく「このモデルについて」セクションをご覧ください。
DeepSeek V4 Flash (0731) の料金はいくらですか?
Synthorai 上の DeepSeek V4 Flash (0731) は入力 100 万トークンあたり $0.2、出力 100 万トークンあたり $0.4 です。ベンダー定価のままで、プラットフォーム手数料はありません。キャッシュ済み入力トークンは $0.04/M で課金されます。
DeepSeek V4 Flash (0731) はプロンプトキャッシュに対応していますか?
はい、自動で有効です。DeepSeek 経由のプロンプトはコード変更なしでキャッシュされます。キャッシュ済み入力トークンは $0.04/M(未キャッシュは $0.2/M)で課金されます。 プロンプトキャッシュガイド →
DeepSeek V4 Flash (0731) を利用するには?
お使いの OpenAI SDK の base_url を "https://synthorai.io/v1" に向け、model="deepseek-v4-flash-0731" を設定すれば完了です。API キー 1 本でゲートウェイ上のすべてのモデルを利用できます。
DeepSeek V4 Flash (0731) はオープンソースですか?
はい。ウェイトは MIT ライセンス で公開されています。GPU を用意する必要もありません。ここでホストされる版は従量課金で、自前のインフラ運用は不要です。 オープンウェイトモデルの実行について →