GLM-5-Turbo 是 Z.AI 針對 OpenClaw 智慧體場景深度最佳化的基礎模型。
- 輸入
- 文字 $1.2/M
- 輸出
- 文字 $4/M
- 快取讀取
- $0.24/M
- 上下文
- 205K
- 相較 GPT-4o
- 便宜約 76%
價格在同類中的位置
價格在 60 個同類模型中的位置
這條線顯示該模型的價格,在 Synthorai 上同類模型裡處於什麼位置。兩端標出了最便宜和最貴的那個。這裡是基礎價,批次、區域與快取寫入的折扣見價格頁。
規格與限制
Token
| 上下文視窗(廠商規格) | 200,000 |
|---|---|
| 最大輸出(廠商規格) | 131,072 |
提示詞快取
| 快取方式 | 自動 |
|---|
思考
| 廠商參數 | thinking.type |
|---|---|
| 可選值 | enabled · disabled |
| 預設值 | enabled,由模型自動判斷是否思考 請求未指定時生效 |
| 可關閉 | 支援 |
| 思考行為 | 思考軌跡透過 reasoning_content 回傳;先前輪次的軌跡預設會被清除(clear_thinking 為 true),交錯思考的 thinking 區塊則應保留並與工具結果一併回傳。 |
| 參數 | reasoning_effort |
| 取值 | minimal · low · medium · high 閘道側參數面——以上方廠商映射為準 |
模型
| 模態 | 文字 → 文字 |
|---|
- 僅提供 API 的速度最佳化 GLM-5 變體,針對 OpenClaw 智慧體場景調校:工具呼叫更可靠,長時間任務更穩定
- 200K 上下文 / 128K 最大輸出
依據 Z.ai 官方文件 ↗
30 秒用上 GLM-5-Turbo
OpenAI 相容:換掉 base_url,SDK 不用改。POST /v1/chat/completions
from openai import OpenAI
client = OpenAI(
base_url="https://synthorai.io/v1",
api_key="sk-syn-...",
)
resp = client.chat.completions.create(
model="glm-5-turbo",
messages=[{"role": "user", "content": "Summarize this diff"}],
reasoning_effort="medium",
)
print(resp.choices[0].message.content)import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://synthorai.io/v1",
apiKey: "sk-syn-...",
});
const resp = await client.chat.completions.create({
model: "glm-5-turbo",
messages: [{ role: "user", content: "Summarize this diff" }],
reasoning_effort: "medium",
});
console.log(resp.choices[0].message.content);curl https://synthorai.io/v1/chat/completions \
-H "Authorization: Bearer sk-syn-..." \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5-turbo",
"messages": [{"role": "user", "content": "Hello"}],
"reasoning_effort": "medium"
}'package main
import (
"context"
"fmt"
"github.com/openai/openai-go/v3"
"github.com/openai/openai-go/v3/option"
)
func main() {
client := openai.NewClient(
option.WithBaseURL("https://synthorai.io/v1"),
option.WithAPIKey("sk-syn-..."),
)
resp, _ := client.Chat.Completions.New(context.TODO(), openai.ChatCompletionNewParams{
Model: "glm-5-turbo",
Messages: []openai.ChatCompletionMessageParamUnion{
openai.UserMessage("Summarize this diff"),
},
ReasoningEffort: openai.ReasoningEffortMedium,
})
fmt.Println(resp.Choices[0].Message.Content)
}import com.openai.client.OpenAIClient;
import com.openai.client.okhttp.OpenAIOkHttpClient;
import com.openai.models.chat.completions.*;
import com.openai.models.ReasoningEffort;
OpenAIClient client = OpenAIOkHttpClient.builder()
.baseUrl("https://synthorai.io/v1")
.apiKey("sk-syn-...")
.build();
ChatCompletion resp = client.chat().completions().create(
ChatCompletionCreateParams.builder()
.model("glm-5-turbo")
.addUserMessage("Summarize this diff")
.reasoningEffort(ReasoningEffort.MEDIUM)
.build());
System.out.println(resp.choices().get(0).message().content().orElse(""));關於 GLM-5-Turbo
- 相較於基礎的 GLM-5,官方文件強調四項針對性升級:更精準的工具呼叫、對複雜指令更強的拆解能力、對定時與常駐任務的時間感知處理,以及長邏輯鏈上更高的吞吐量。
- 它提供 200K 上下文視窗與最高 128K 輸出 token,並支援思考模式、串流、函式呼叫、上下文快取、結構化 JSON 輸出與 MCP 工具整合。
- Z.AI 把這次釋出定位為提升長鏈智慧體任務的穩定性與效率,而非提升原始智慧,並列出它調校過的領域:安裝與設定、程式碼開發、資訊蒐集、資料分析、內容創作、辦公生產力、財務分析、維運工程與研究。
- 這份清單是理解它的老實方式:它是智慧體框架的專才,而非通用型的同門。
- 思考沿用 GLM-5 的慣例,預設開啟並由模型自行決定是否推理,推理軌跡與答案分開回傳。
- 外部技能可以與工具一併呼叫,工具呼叫的參數也可以增量串流輸出。
- 有兩點使它與產品線其餘成員不同:Z.AI 不公布它的參數量;而且不同於 GLM-5、5.1 和 5.2,它沒有開放權重釋出,只提供 API。
- 在 Synthorai 上,GLM-5-Turbo 可透過標準的 OpenAI 相容 API 呼叫。
常見問題
GLM-5-Turbo API 可以免費試用嗎?
可以,新帳號可獲得 10 次試用呼叫和最高 $1 的免費額度,無需信用卡。以輸入 $1.2/M 計算,光是這筆額度就足以對 GLM-5-Turbo 發出約 104 次 ~8K token 的請求。
GLM-5-Turbo 最擅長什麼?
為 OpenClaw 智慧體場景深度最佳化、工具呼叫與指令拆解更精準、時間感知處理定時與持久任務。完整能力請見「關於」一節,內容取自廠商官方發布說明。
GLM-5-Turbo 的價格是多少?
在 Synthorai 上,GLM-5-Turbo 輸入 $1.2/百萬 token、輸出 $4/百萬 token,即廠商牌價,無平台加價。快取命中的輸入 token 以 $0.24/M 計費。
GLM-5-Turbo 支援提示詞快取(prompt caching)嗎?
支援,且全自動:由 Z.ai 供應的提示詞會自動快取,無需改程式碼。快取命中的輸入 token 以 $0.24/M 計費(未命中 $1.2/M)。 提示詞快取指南 →
如何開通 GLM-5-Turbo?
把現有 OpenAI SDK 的 base_url 指向 "https://synthorai.io/v1",model 設為 "glm-5-turbo" 即可。一組 API key 通用閘道上的所有模型。
相關模型
對比
本頁每個值都轉錄自廠商自己的文件(連結見上),並帶有核對日期。價格在全目錄範圍內比較;各廠商定義不同的規格值,只說明差異而不作圖表對比。此處沒有任何由我們測量的資料,也不做評分。