Qwen3.8 Max
厂商牌价,无平台加价,按量付费。 以下为官方 list 价。登录客户可在 /console/pricing 查看含工作空间折扣的实际价格。 按 70% 缓存命中率计算的等效输入价:$0.775/M. 隐式上下文缓存自动生效;显式 cache_control 模式提供更深折扣(最小块 1,024 token,5 分钟 TTL、命中即重置)。各模型缓存读取价见价格表。
30 秒用上 Qwen3.8 Max
OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="qwen3.8-max",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "qwen3.8-max",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-max",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "qwen3.8-max",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("qwen3.8-max")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));规格与限制
Token
- 上下文窗口(厂商规格)
- 983,616
- 最大输出(厂商规格)
- 131,072
提示词缓存
- 缓存方式
- 自动 + 显式
- 存活时间
- 显式模式:5 分钟,命中即重置
思考
- 取值
- minimal · low · medium · high 具体接受哪些由厂商决定
模型
- 模态
- 文本 + 图像 → 文本
- 参数量
- 总参数 2.4T MoE
- Flagship Qwen3.8 Max: natively vision-language, 2.4T-parameter MoE
- thinking trace returned in reasoning_content
- text and image in, text out
关于 Qwen3.8 Max
Qwen3.8 Max 是阿里巴巴于 2026 年 8 月 3 日发布的通义千问旗舰模型。
- 官方描述称它是原生视觉语言的 Max 模型,采用混合专家(MoE)架构、参数规模 2.4 万亿,是千问系列迄今能力最强的模型。
- 它接受文本和图像输入并返回文本,因此一次请求就能把提示词与截图、图表或扫描件放在一起,不必再把图像绕到另一个视觉模型上。
- 思考是默认行为的一部分:模型会在 reasoning_content 字段里单独返回思维轨迹,这意味着即便回答很短也会消耗推理 token,把 max_tokens 设得很小时可能出现请求成功但回答为空的情况。
- 函数调用、严格 JSON schema 结构化输出、以及在末帧带 usage 的流式都可用,接进既有的 OpenAI 兼容集成无需特殊处理。
- 上下文接近一百万 token,单次响应最高 131,072 token,是上一代 Max 输出上限的两倍,这也是把长文生成迁到它上面最具体的理由。
- 计价按缓存行为分档而非按上下文长度:标准输入价、自动缓存命中的更低价,以及显式创建与读取缓存各自独立的价格,因此复用稳定前缀的智能体循环能实质性受益。
- 阿里列出的可用区域为北京与新加坡。
- Synthorai 通过 OpenAI 兼容的 chat completions 端点提供该模型。
常见问题
Qwen3.8 Max API 可以免费试用吗?
可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $2/M 计算,仅这笔额度就足够对 Qwen3.8 Max 发起约 62 次 ~8K token 的请求。
Qwen3.8 Max 最擅长什么?
2.4 万亿参数 MoE,原生视觉语言、文本与图像输入,输出最高 131K、按缓存分档计价,利好提示密集型循环。完整能力请见「关于」部分,内容取自厂商官方发布说明。
Qwen3.8 Max 的价格是多少?
在 Synthorai 上,Qwen3.8 Max 输入 $2/百万 token、输出 $6/百万 token,即厂商牌价,无平台加价。缓存命中的输入 token 按 $0.25/M 计费。
Qwen3.8 Max 支持提示词缓存(prompt caching)吗?
支持:自动缓存默认开启,另有显式模式可获得确定性折扣。缓存命中的输入 token 按 $0.25/M 计费(未命中 $2/M)(TTL 显式模式:5 分钟,命中即重置)。 提示词缓存指南 →
如何开通 Qwen3.8 Max?
把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "qwen3.8-max" 即可。一把 API key 通用网关上的全部模型。