Alibaba
Jedes Alibaba-Modell auf Synthorai: ein Endpoint, Live-Preise.
23 Modelle · chat / tools / reasoning / code · ab $0.05/M Input
Warum Alibaba über Synthorai
- Bringen Sie Ihren eigenen Key mit. Bringen Sie Ihren eigenen Alibaba-Cloud-DashScope-Key mit: ohne Aufschlag, kostenlos.
- Keine Prompt-Speicherung. Standardmäßig keine Prompt-Speicherung am Gateway; upstream gelten die API-Datenrichtlinien von Alibaba Cloud. Details →
- Prompt-Caching. Impliziter Kontext-Cache ist automatisch; ein expliziter cache_control-Modus bietet tiefere Rabatte (Mindestblöcke von 1.024 Token, 5-Minuten-TTL, die bei einem Treffer zurückgesetzt wird). Die Preise für gecachte Lesezugriffe pro Modell stehen in der Preistabelle. Cache-Lesezugriffe ab $0.022/M.
Position von Alibaba · Eingabepreis über 60 Chat-Modelle
- Alibaba $0.05 - $2.5
- ByteDance $0.1 - $0.5
- Google $0.1 - $2
- DeepSeek $0.138 - $1.32
- Tencent $0.14
- OpenAI $0.2 - $30
- MiniMax $0.22 - $0.3
- Moonshot $0.574 - $3
- Anthropic $1 - $10
- Z.ai $1 - $1.4
Jeder Balken reicht vom günstigsten bis zum teuersten Chat-Modell eines Anbieters, sodass sichtbar wird, wo dieser im Vergleich zum übrigen Katalog steht.
Alibaba-Modelle & Preise
Chat 10 Modelle
| Modell | Input /M | Output /M | Cache-Read /M | Kontext |
|---|---|---|---|---|
| Qwen3 Coder Nextgeschlossene Beta | $0.11 | $0.8 | $0.022 | 262K |
| Qwen3 Max | $1.2 | $6 | $0.359 | 256K |
| Qwen3 VL Flash | $0.05 | $0.4 | $0.022 | 256K |
| Qwen3 VL Plus | $0.2 | $1.6 | $0.143 | 256K |
| Qwen3.5 Flash | $0.1 | $0.4 | $0.029 | 1M |
| Qwen3.5 Plus | $0.4 | $2.4 | $0.115 | 1M |
| Qwen3.6 Flash | $0.25 | $1.5 | $0.05 | 256K |
| Qwen3.7 Max | $2.5 | $7.5 | $0.5 | 1M |
| Qwen3.7 Plus | $0.4 | $1.6 | $0.08 | 1M |
| Qwen3.8 Max | $2 | $6 | $0.25 | 984K |
Bild 5 Modelle
| Modell | Pro Bild |
|---|---|
| qwen-image-2.0 | $0.035/img |
| qwen-image-2.0-pro | $0.075/img |
| qwen-image-3.0 | $0.03/img |
| wan2.7-image | $0.03/img |
| wan2.7-image-pro | $0.075/img |
Audio 7 Modelle
| Modell | Pro Minute |
|---|---|
| Fun-ASR | $0.0021/min |
| Fun-ASR Flash | $0.0021/min |
| Fun-ASR MTL | $0.0021/min |
| Fun-ASR Realtime | $0.002/min |
| Paraformer Realtime v2 | $0.002/min |
| Qwen3-ASR Flash | $0.0021/min |
| Qwen3-ASR Flash Realtime | $0.002/min |
Sprachsynthese 1 Modell
| Modell | Pro Mio. Zeichen |
|---|---|
| Qwen3 TTS Instruct Flash | $11.5 |
Listenpreise der Anbieter, ohne Plattform-Aufschlag. Die Preise werden auf jeder Modellseite live aktualisiert. Dies sind offizielle Listenpreise. Angemeldete Kunden sehen auf /console/pricing die effektiven Preise inklusive Workspace-Rabatten.
Alibaba-Modelle in 30 Sekunden nutzen
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3.7-max",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3.7-max",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.7-max",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3.7-max",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3.7-max")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));Über Alibaba
Alibabas Qwen-Familie ist eine der breitesten open-weight-basierten Produktlinien in der Produktion: Max/Plus/Turbo-Chat-Stufen, starke mehrsprachige und chinesischsprachige Leistung, Coder-Varianten und die Qwen-Image-Generierungsreihe. Auf Synthorai sitzt die gesamte Qwen-Reihe hinter einem OpenAI-kompatiblen Endpoint mit Live-Preisen pro Modell. Ein Alibaba-Cloud-Konto ist nicht erforderlich.
FAQ
Wie bekomme ich einen Alibaba-API-Key ohne Abo?
Sie brauchen kein Alibaba-Konto: Registrieren Sie sich bei Synthorai, erstellen Sie einen API-Key, und jedes Alibaba-Modell auf dieser Seite funktioniert über den OpenAI-kompatiblen Endpoint: nutzungsbasierte Abrechnung, ohne Abo (als „geschlossene Beta“ markierte Modelle erfordern zusätzlich eine genehmigte Bewerbung).
Was kostet die Alibaba API?
Token-basiert abgerechnete Modelle starten bei $0.05/M Input-Tokens; der Live-Preis pro Einheit steht für jedes Modell in der Tabelle oben; es sind Listenpreise der Anbieter ohne Plattform-Aufschlag.
Kann ich meinen eigenen Alibaba-Key nutzen (BYOK)?
Ja. Bringen Sie Ihren eigenen Alibaba-Cloud-DashScope-Key mit: ohne Aufschlag, kostenlos. Ihr Key bleibt in einem verschlüsselten Vault, und Requests damit werden zum Listenpreis des Anbieters abgerechnet.
Wie sieht die Datenspeicherungs-Richtlinie von Alibaba über die API aus?
Standardmäßig keine Prompt-Speicherung am Gateway; upstream gelten die API-Datenrichtlinien von Alibaba Cloud.
Weitere Anbieter