新人 免费注册,送 10 次调用,最高 $1,无需绑卡。

MiniMax M3 vs Qwen3.7 Plus

MiniMax M3 已从我们的目录下线。下方是它最后公布的价格;这个模型已无法调用,对比中的另一个模型仍可正常调用。

vs

什么时候选哪个

这两者纸面上很接近:minimax-m3 和 qwen3.7-plus 都提供 1000000 token 上下文、文本/图像/视频输入与文本输出、同样的对话、代码、推理、工具和长上下文标志,思考都可关闭,而且都在 2026-06-01 发布。区分点是价目表和输出上限:qwen3.7-plus 在输入($0.4 对 $0.3)、输出($1.6 对 $1.2)和缓存读取($0.08 对 $0.06)上都约为 minimax-m3 的 1.33 倍,而 minimax-m3 允许 524288 最大输出 token 而非 65536,即 8 倍的空间。更便宜的运行和超长单次生成选 minimax-m3;偏好阿里作为厂商则选 qwen3.7-plus。

Benchmark 成绩

MiniMax M3:供应商没有公布 benchmark 成绩。

高于同类均值无更高分Qwen3.7 Plus11 / 244 / 24
MiniMax M3 Qwen3.7 Plus 其他参测模型 同类均值 ★ 没有模型得分更高
SWE-Bench Pro
N/A
55.8%
OSWorld 2.0 partial
N/A
21.5%
JobBench
N/A
27.6%
GPQA Diamond
N/A
90.3%
ERQA
N/A
69.8%
Agents' Last Exam Pass
N/A
13.2%
LVBench
N/A
76.2%

供应商公布: Alibaba (Qwen) Anthropic ByteDance DeepSeek Google MiniMax Moonshot OpenAI Tencent Z.ai

价格

MiniMax M3 Qwen3.7 Plus Δ
输入 / 1M token $0.3 $0.4 0.75×
输出 / 1M token $1.2 $1.6 0.75×
缓存读取 / 1M token $0.06 $0.08 0.75×
缓存写入 不单独收费 1.25x -

价格取自构建时的实时目录,最新价格见各模型页面。

两个模型所处的位置:全部 76 个按同一单位计费的聊天模型的每 1M token 输入价分布(对数刻度)

MiniMax M3 · $0.3 Qwen3.7 Plus · $0.4
$0.05 · Qwen3 VL Flash $30 · GPT-5.4 Pro

能力

MiniMax M3 Qwen3.7 Plus
工具调用 是 是
思考控制 可配置 可配置
结构化输出 - 是
提示词缓存 隐式(自动) 隐式 + 显式
缓存有效期 未公布 explicit: 5m, reset on hit
最小缓存前缀 512 个 token 1024 个 token

规格

MiniMax M3 Qwen3.7 Plus
输入模态 文本 图像 视频 文本 图像 视频
输出模态 文本 文本
发布日期 2026-06-01 2026-06-01
上下文窗口 1M 1M
最大输出 524K 66K
思考参数
  • thinking.type
  • reasoning_split
  • enable_thinking
  • thinking_budget
  • preserve_thinking
可选值
thinking.type
  • adaptive
  • disabled
reasoning_split
  • boolean
enable_thinking
  • true
  • false
thinking_budget
  • in tokens
preserve_thinking
  • true
  • false
默认值 adaptive: thinking on, with the model deciding when extra reasoning helps

on

the Qwen3.7 Plus series is hybrid thinking with thinking enabled by default, and preserve_thinking is off

规格照录自各供应商的文档;供应商没有公布的项目,对应的行直接省略,不做推断。 完整来源: MiniMax M3 · Qwen3.7 Plus

改一行代码就能在两个模型之间切换

下方每个标签页里都有两个模型 ID,高亮的那两行是唯一要改的地方。端点不变,API key 不变,请求结构也不变。

from openai import OpenAI

client = OpenAI(
    base_url="https://synthorai.io/v1",
    api_key="sk-syn-...",
)

resp = client.chat.completions.create(
    model="minimax-m3",
    # model="qwen3.7-plus",  # 取消注释此行,注释上一行
    messages=[{"role": "user", "content": "Summarize this diff"}],
    reasoning_effort="medium",
)
print(resp.choices[0].message.content)

获取 API key →

常见问题

MiniMax M3 和 Qwen3.7 Plus 哪个更便宜?

按「输入 / 1M token」算,MiniMax M3 更便宜($0.3 对 $0.4,相差 1.3×)。其他计费项的结论可能相反,完整价格见上方表格,实际成本取决于你的用量构成。

不用分别集成两次,就能对 MiniMax M3 和 Qwen3.7 Plus 做 A/B 测试吗?

可以。两个模型走同一个 OpenAI 兼容端点,用同一个 API key,切换时只要改一行里的模型名,所以可以给两个模型各分一部分流量,直接对比账单。

MiniMax M3 和 Qwen3.7 Plus 支持提示词缓存吗?

支持。两个模型的缓存读取价都低于各自的输入价,所以前缀能反复命中缓存的负载,实际成本会比按官网价估算的低。具体的缓存读取价见上方价格表。

相关对比

我们的实测研究