Neu Kostenlos registrieren und 10 Aufrufe gratis nutzen. Bis zu 1 $, ohne Kreditkarte.

DeepSeek V4 Flash (0731) vs MiniMax M3

MiniMax M3 haben wir aus dem Katalog genommen. Die Werte unten sind die zuletzt veröffentlichten Preise. Aufrufe an dieses Modell nehmen wir nicht mehr an, das andere Modell dieses Vergleichs ist weiterhin verfügbar.

vs

Welches Modell wofür

Sowohl deepseek-v4-flash-0731 als auch minimax-m3 sind Textausgabe-Modelle mit einem Kontext von 1000000 Token, und minimax-m3 ist bei frischen Token die etwas günstigere Seite: $0.3 pro Million bei der Eingabe und $1.2 bei der Ausgabe gegenüber $0.44 und $1.32. deepseek-v4-flash-0731 behält den Vorteil bei der Wiederverwendung, mit Cache-Lesevorgängen zu $0.044 gegenüber $0.06, etwa 1.4x weniger, wobei seine maximale Ausgabe von 393216 Token hinter der Obergrenze von 524288 zurückbleibt. Wählen Sie minimax-m3, wenn Sie Bild- oder Videoeingaben, die größere maximale Ausgabe oder die Option zum Deaktivieren des Thinking benötigen. Wählen Sie deepseek-v4-flash-0731 für reine Textarbeit bei Chat, Code und Reasoning, bei der zwischengespeicherte Präfixe die Rechnung dominieren.

Benchmarks

MiniMax M3: Der Anbieter hat keine Benchmark-Werte veröffentlicht.

Über dem DurchschnittDeepSeek V4 Flash (0731)10 / 28
DeepSeek V4 Flash (0731) MiniMax M3 weitere gemessene Modelle Durchschnitt der Vergleichsmodelle ★ kein anderes Modell war besser
SWE-Bench Pro
56%
N/A
Cybergym
76.7%
N/A
JobBench
41.3%
N/A
GPQA Diamond
89.9%
N/A
Agents' Last Exam
25.2%
N/A

Anbieterangaben: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preise

DeepSeek V4 Flash (0731) MiniMax M3 Δ
Eingabe / 1M Tokens $0.44 $0.3 1.5×
Ausgabe / 1M Tokens $1.32 $1.2 1.1×
Cache-Lesen / 1M Tokens $0.044 $0.06 0.73×
Cache-Schreiben keine gesonderte Gebühr keine gesonderte Gebühr -

Preise aus dem Live-Katalog, Stand des letzten Builds. Die aktuellen Preise stehen auf der jeweiligen Modellseite.

Einordnung: Eingabepreis pro 1M Tokens aller 76 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

Fähigkeiten

DeepSeek V4 Flash (0731) MiniMax M3
Tool-Nutzung ja ja
Thinking-Steuerung ja, Parameter des Anbieters nicht veröffentlicht konfigurierbar
Strukturierte Ausgabe ja -
Prompt-Caching implizit (automatisch) implizit (automatisch)
Cache-Lebensdauer no fixed TTL (evicted when unused) nicht veröffentlicht
Mindestlänge des gecachten Präfixes nicht veröffentlicht 512 Tokens

Spezifikationen

DeepSeek V4 Flash (0731) MiniMax M3
Eingabemodalitäten Text Text Bild Video
Ausgabemodalitäten Text Text
Veröffentlicht 2026-07-31 2026-06-01
Kontextfenster 1M 1M
Maximale Ausgabe 393K 524K
Thinking-Parameter -
  • thinking.type
  • reasoning_split
Zulässige Werte -
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
Standardwert - adaptive: thinking on, with the model deciding when extra reasoning helps

Die Spezifikationen stammen aus der Dokumentation des jeweiligen Anbieters. Veröffentlicht ein Anbieter eine Angabe nicht, lassen wir die Zeile weg, statt sie zu schätzen. Vollständige Quellen: DeepSeek V4 Flash (0731) · MiniMax M3

Eine Zeile genügt für den Wechsel

Beide IDs stehen in jedem Tab unten. Die beiden hervorgehobenen Zeilen sind die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiches Anfrageformat.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="deepseek-v4-flash-0731",
    # model="minimax-m3",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API-Schlüssel erstellen →

FAQ

Welches Modell ist günstiger: DeepSeek V4 Flash (0731) oder MiniMax M3?

MiniMax M3 ist bei Eingabe / 1M Tokens günstiger ($0.3 vs. $0.44, Faktor 1.5). Bei anderen Zeilen kann es umgekehrt sein. Die Tabelle oben zeigt alle Preise, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich DeepSeek V4 Flash (0731) gegen MiniMax M3 A/B-testen, ohne zweimal zu integrieren?

Ja. Beide laufen über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel. Für den Wechsel ändern Sie nur eine Zeile, den Modellnamen. So können Sie einen Teil des Traffics an jedes Modell schicken und die Kosten direkt vergleichen.

Unterstützen DeepSeek V4 Flash (0731) und MiniMax M3 Prompt-Caching?

Ja. Beide berechnen Cache-Lesezugriffe günstiger als die normale Eingabe. Workloads mit einem wiederkehrenden, bereits gecachten Präfix kosten deshalb weniger, als die Listenpreise vermuten lassen. Die genauen Preise stehen in den Cache-Zeilen der Preistabelle oben.

Verwandte Vergleiche

Aus unseren Studien mit eigenen Messungen