MiniMax M3 vs Qwen3.7 Plus
MiniMax M3 haben wir aus dem Katalog genommen. Die Werte unten sind die zuletzt veröffentlichten Preise. Aufrufe an dieses Modell nehmen wir nicht mehr an, das andere Modell dieses Vergleichs ist weiterhin verfügbar.
Welches Modell wofür
Diese beiden liegen auf dem Papier dicht beieinander: minimax-m3 wie qwen3.7-plus bieten einen Kontext von 1000000 Tokens, Text-/Bild-/Videoeingabe mit Textausgabe und dieselben Chat-, Code-, Reasoning-, Tool- und Langkontext-Flags, mit abschaltbarem Denken, und beide erschienen am 2026-06-01. Getrennt werden sie durch Preisliste und Ausgabegrenze: qwen3.7-plus berechnet rund das 1.33-fache von minimax-m3 bei der Eingabe ($0.4 gegenüber $0.3), der Ausgabe ($1.6 gegenüber $1.2) und den Cache-Lesevorgängen ($0.08 gegenüber $0.06), während minimax-m3 524288 maximale Ausgabetokens gegenüber 65536 erlaubt, also den achtfachen Raum. Nehmen Sie minimax-m3 für günstigere Läufe und sehr lange Einzelgenerierungen; nehmen Sie qwen3.7-plus, wenn Sie Alibaba als Anbieter bevorzugen.
Benchmarks
MiniMax M3: Der Anbieter hat keine Benchmark-Werte veröffentlicht.
Anbieterangaben: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai
Preise
| MiniMax M3 | Qwen3.7 Plus | Δ | |
|---|---|---|---|
| Eingabe / 1M Tokens | $0.3 | $0.4 | 0.75× |
| Ausgabe / 1M Tokens | $1.2 | $1.6 | 0.75× |
| Cache-Lesen / 1M Tokens | $0.06 | $0.08 | 0.75× |
| Cache-Schreiben | keine gesonderte Gebühr | 1.25x | - |
Preise aus dem Live-Katalog, Stand des letzten Builds. Die aktuellen Preise stehen auf der jeweiligen Modellseite.
Einordnung: Eingabepreis pro 1M Tokens aller 76 Chat-Modelle mit dieser Abrechnungseinheit (logarithmische Skala)
Fähigkeiten
| MiniMax M3 | Qwen3.7 Plus | |
|---|---|---|
| Tool-Nutzung | ja | ja |
| Thinking-Steuerung | konfigurierbar | konfigurierbar |
| Strukturierte Ausgabe | - | ja |
| Prompt-Caching | implizit (automatisch) | implizit + explizit |
| Cache-Lebensdauer | nicht veröffentlicht | explicit: 5m, reset on hit |
| Mindestlänge des gecachten Präfixes | 512 Tokens | 1024 Tokens |
Spezifikationen
| MiniMax M3 | Qwen3.7 Plus | |
|---|---|---|
| Eingabemodalitäten | Text Bild Video | Text Bild Video |
| Ausgabemodalitäten | Text | Text |
| Veröffentlicht | 2026-06-01 | 2026-06-01 |
| Kontextfenster | 1M | 1M |
| Maximale Ausgabe | 524K | 66K |
| Thinking-Parameter |
|
|
| Zulässige Werte | thinking.type
reasoning_split
| enable_thinking
thinking_budget
preserve_thinking
|
| Standardwert | adaptive: thinking on, with the model deciding when extra reasoning helps | on the Qwen3.7 Plus series is hybrid thinking with thinking enabled by default, and preserve_thinking is off |
Die Spezifikationen stammen aus der Dokumentation des jeweiligen Anbieters. Veröffentlicht ein Anbieter eine Angabe nicht, lassen wir die Zeile weg, statt sie zu schätzen. Vollständige Quellen: MiniMax M3 · Qwen3.7 Plus
Eine Zeile genügt für den Wechsel
Beide IDs stehen in jedem Tab unten. Die beiden hervorgehobenen Zeilen sind die einzige Änderung. Gleicher Endpunkt, gleicher Schlüssel, gleiches Anfrageformat.
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="minimax-m3",
# model="qwen3.7-plus", # diese Zeile einkommentieren, die darüberliegende auskommentieren
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "minimax-m3",
// model: "qwen3.7-plus", // diese Zeile einkommentieren, die darüberliegende auskommentieren
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "minimax-m3",
# "model": "qwen3.7-plus", # diese Zeile einkommentieren, die darüberliegende auskommentieren
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "minimax-m3",
// Model: "qwen3.7-plus", // diese Zeile einkommentieren, die darüberliegende auskommentieren
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("minimax-m3")
// .model("qwen3.7-plus") // diese Zeile einkommentieren, die darüberliegende auskommentieren
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));FAQ
Welches Modell ist günstiger: MiniMax M3 oder Qwen3.7 Plus?
MiniMax M3 ist bei Eingabe / 1M Tokens günstiger ($0.3 vs. $0.4, Faktor 1.3). Bei anderen Zeilen kann es umgekehrt sein. Die Tabelle oben zeigt alle Preise, und die tatsächlichen Kosten hängen von Ihrem Mix ab.
Kann ich MiniMax M3 gegen Qwen3.7 Plus A/B-testen, ohne zweimal zu integrieren?
Ja. Beide laufen über denselben OpenAI-kompatiblen Endpunkt mit einem API-Schlüssel. Für den Wechsel ändern Sie nur eine Zeile, den Modellnamen. So können Sie einen Teil des Traffics an jedes Modell schicken und die Kosten direkt vergleichen.
Unterstützen MiniMax M3 und Qwen3.7 Plus Prompt-Caching?
Ja. Beide berechnen Cache-Lesezugriffe günstiger als die normale Eingabe. Workloads mit einem wiederkehrenden, bereits gecachten Präfix kosten deshalb weniger, als die Listenpreise vermuten lassen. Die genauen Preise stehen in den Cache-Zeilen der Preistabelle oben.