🎁 新人 免费注册,送 10 次调用,最高 $1,免绑卡。

Qwen3.8 Max 发布于 2026-08-03

Alibaba chat图像理解代码推理工具调用长上下文结构化输出流式输出提示词缓存
输入$2/M
输出$6/M
缓存读取$0.25/M
上下文984K
对比 GPT-4o便宜约 60%

厂商牌价,无平台加价,按量付费。 以下为官方 list 价。登录客户可在 /console/pricing 查看含工作空间折扣的实际价格。 按 70% 缓存命中率计算的等效输入价:$0.775/M. 隐式上下文缓存自动生效;显式 cache_control 模式提供更深折扣(最小块 1,024 token,5 分钟 TTL、命中即重置)。各模型缓存读取价见价格表。

30 秒用上 Qwen3.8 Max

OpenAI 兼容:换掉 base_url,SDK 不用改。POST /v1/chat/completions

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="qwen3.8-max",
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

规格与限制

Token

上下文窗口(厂商规格)
983,616
最大输出(厂商规格)
131,072

提示词缓存

缓存方式
自动 + 显式
存活时间
显式模式:5 分钟,命中即重置

思考

取值
minimal · low · medium · high 具体接受哪些由厂商决定

模型

模态
文本 + 图像 → 文本
参数量
总参数 2.4T MoE
  • Flagship Qwen3.8 Max: natively vision-language, 2.4T-parameter MoE
  • thinking trace returned in reasoning_content
  • text and image in, text out

依据 Alibaba 官方文档 ↗

关于 Qwen3.8 Max

2.4 万亿参数 MoE,原生视觉语言
文本与图像输入,输出最高 131K
按缓存分档计价,利好提示密集型循环

Qwen3.8 Max 是阿里巴巴于 2026 年 8 月 3 日发布的通义千问旗舰模型。

  • 官方描述称它是原生视觉语言的 Max 模型,采用混合专家(MoE)架构、参数规模 2.4 万亿,是千问系列迄今能力最强的模型。
  • 它接受文本和图像输入并返回文本,因此一次请求就能把提示词与截图、图表或扫描件放在一起,不必再把图像绕到另一个视觉模型上。
  • 思考是默认行为的一部分:模型会在 reasoning_content 字段里单独返回思维轨迹,这意味着即便回答很短也会消耗推理 token,把 max_tokens 设得很小时可能出现请求成功但回答为空的情况。
  • 函数调用、严格 JSON schema 结构化输出、以及在末帧带 usage 的流式都可用,接进既有的 OpenAI 兼容集成无需特殊处理。
  • 上下文接近一百万 token,单次响应最高 131,072 token,是上一代 Max 输出上限的两倍,这也是把长文生成迁到它上面最具体的理由。
  • 计价按缓存行为分档而非按上下文长度:标准输入价、自动缓存命中的更低价,以及显式创建与读取缓存各自独立的价格,因此复用稳定前缀的智能体循环能实质性受益。
  • 阿里列出的可用区域为北京与新加坡。
  • Synthorai 通过 OpenAI 兼容的 chat completions 端点提供该模型。

常见问题

Qwen3.8 Max API 可以免费试用吗?

可以。新账号可获得 10 次试用调用和最高 $1 的免费额度,无需绑卡。按输入 $2/M 计算,仅这笔额度就足够对 Qwen3.8 Max 发起约 62 次 ~8K token 的请求。

Qwen3.8 Max 最擅长什么?

2.4 万亿参数 MoE,原生视觉语言、文本与图像输入,输出最高 131K、按缓存分档计价,利好提示密集型循环。完整能力请见「关于」部分,内容取自厂商官方发布说明。

Qwen3.8 Max 的价格是多少?

在 Synthorai 上,Qwen3.8 Max 输入 $2/百万 token、输出 $6/百万 token,即厂商牌价,无平台加价。缓存命中的输入 token 按 $0.25/M 计费。

Qwen3.8 Max 支持提示词缓存(prompt caching)吗?

支持:自动缓存默认开启,另有显式模式可获得确定性折扣。缓存命中的输入 token 按 $0.25/M 计费(未命中 $2/M)(TTL 显式模式:5 分钟,命中即重置)。 提示词缓存指南 →

如何开通 Qwen3.8 Max?

把现有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 设为 "qwen3.8-max" 即可。一把 API key 通用网关上的全部模型。

相关模型

免费获取 API key 算算你的成本 →