Neu Kostenlos registrieren und 10 Aufrufe gratis nutzen. Bis zu 1 $, ohne Kreditkarte.

MiniMax M3 vs Qwen3.8 Max

MiniMax M3 haben wir aus dem Katalog genommen. Die Werte unten sind die zuletzt veröffentlichten Preise. Aufrufe an dieses Modell nehmen wir nicht mehr an, das andere Modell dieses Vergleichs ist weiterhin verfügbar.

vs

Welches Modell wofür

minimax-m3 ist auf jeder Zeile der Preisliste das günstigere der beiden, zu $0.3 Eingabe und $1.2 Ausgabe gegenüber $2 und $6 bei qwen3.8-max - rund 6.7x und 5x weniger - und es akzeptiert zudem Video neben Text und Bild, führt einen Kontext von 1000000 Tokens mit bis zu 524288 Tokens Ausgabe und lässt das Denken abschalten. qwen3.8-max kostet mehr und begrenzt die Ausgabe auf 131072 Tokens bei einem Kontext von 983616 Tokens - greifen Sie dazu, wenn Sie Alibabas neueres Modell vom August 2026 mit ausdrücklichem Vision-Flag für Text- und Bildarbeit wollen. Für Aufgaben mit großer Menge, langer Ausgabe oder Videoeingabe ist minimax-m3 die wirtschaftliche Wahl.

Benchmarks

MiniMax M3: Der Anbieter hat keine Benchmark-Werte veröffentlicht.

Über dem DurchschnittKeins besserQwen3.8 Max31 / 408 / 40
MiniMax M3 Qwen3.8 Max weitere gemessene Modelle Durchschnitt der Vergleichsmodelle ★ kein anderes Modell war besser
SWE-Bench Pro
N/A
67.7%
AndroidBench
N/A
75.1%
Cybergym
N/A
78.5%
HealthBench
N/A
kein anderes Modell war besser 60.2%
JobBench
N/A
53.4%
PLawBench
N/A
kein anderes Modell war besser 73.2%
GPQA Diamond
N/A
92.6%
Agents' Last Exam
N/A
27%

Anbieterangaben: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

Preise

MiniMax M3 Qwen3.8 Max Δ
Eingabe / 1M Tokens $0.3 $2 0.15×
Ausgabe / 1M Tokens $1.2 $6 0.2×
Cache-Lesen / 1M Tokens $0.06 $0.25 0.24×
Cache-Schreiben keine gesonderte Gebühr 1.25x -

Preise aus dem Live-Katalog, Stand des letzten Builds. Die aktuellen Preise stehen auf der jeweiligen Modellseite.

Einordnung: Eingabepreis pro 1M Tokens aller 76 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)

MiniMax M3 · $0.3 Qwen3.8 Max · $2
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

Fähigkeiten

MiniMax M3 Qwen3.8 Max
Tool-Nutzung ja ja
Thinking-Steuerung konfigurierbar ja, Parameter des Anbieters nicht veröffentlicht
Strukturierte Ausgabe - ja
Prompt-Caching implizit (automatisch) implizit + explizit
Cache-Lebensdauer nicht veröffentlicht explicit: 5m, reset on hit
Mindestlänge des gecachten Präfixes 512 Tokens 1024 Tokens

Spezifikationen

MiniMax M3 Qwen3.8 Max
Eingabemodalitäten Text Bild Video Text Bild
Ausgabemodalitäten Text Text
Veröffentlicht 2026-06-01 2026-08-03
Kontextfenster 1M 984K
Maximale Ausgabe 524K 131K
Thinking-Parameter
  • thinking.type
  • reasoning_split
-
Zulässige Werte
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
-
Standardwert adaptive: thinking on, with the model deciding when extra reasoning helps -

Die Spezifikationen stammen aus der Dokumentation des jeweiligen Anbieters. Veröffentlicht ein Anbieter eine Angabe nicht, lassen wir die Zeile weg, statt sie zu schätzen. Vollständige Quellen: MiniMax M3 · Qwen3.8 Max

Eine Zeile genügt für den Wechsel

Beide IDs stehen in jedem Tab unten. Die beiden hervorgehobenen Zeilen sind die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiches Anfrageformat.

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="minimax-m3",
    # model="qwen3.8-max",  # diese Zeile einkommentieren, die darüberliegende auskommentieren
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

API-Schlüssel erstellen →

FAQ

Welches Modell ist günstiger: MiniMax M3 oder Qwen3.8 Max?

MiniMax M3 ist bei Eingabe / 1M Tokens günstiger ($0.3 vs. $2, Faktor 6.7). Bei anderen Zeilen kann es umgekehrt sein. Die Tabelle oben zeigt alle Preise, und die tatsächlichen Kosten hängen von Ihrem Mix ab.

Kann ich MiniMax M3 gegen Qwen3.8 Max A/B-testen, ohne zweimal zu integrieren?

Ja. Beide laufen über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel. Für den Wechsel ändern Sie nur eine Zeile, den Modellnamen. So können Sie einen Teil des Traffics an jedes Modell schicken und die Kosten direkt vergleichen.

Unterstützen MiniMax M3 und Qwen3.8 Max Prompt-Caching?

Ja. Beide berechnen Cache-Lesezugriffe günstiger als die normale Eingabe. Workloads mit einem wiederkehrenden, bereits gecachten Präfix kosten deshalb weniger, als die Listenpreise vermuten lassen. Die genauen Preise stehen in den Cache-Zeilen der Preistabelle oben.

Verwandte Vergleiche

Aus unseren Studien mit eigenen Messungen