SmartBrain API

Enterprise AI as Simple as Utilities

More Links
Model HubConsoleAPI KeysUsage QueryDocs
SmartBrain API. All rights reserved|Privacy Policy|Terms
SmartBrain API
SmartBrain API
  • Model Hub
  • Official Docs
  • Playground
G

z-ai/glm-5.3

Online Chat
智谱

Publish time

2026/8/14

Model Series

GLM

Input type

Output type

Input Price

¥7.6 / 1M tokens

Output Price

¥26.6 / 1M tokens

Cache Write Price

¥9.5 / 1M tokens

Cache Read Price

¥1.9 / 1M tokens

Context Window

1,000,000

Max Output Length

128,000

GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色。 GLM-5.3 目前仅支持处理文本模态信息,支持 1M 上下文窗口,最大输出 Tokens 为 128K。 GLM-5.3 会始终启用思考功能,支持三个思考强度级别:low、high 和 max,并不再支持禁用思考功能。

Providers for z-ai/glm-5.3

Zhinao API routes requests to the best-fit provider and automatically fails over to the one with highest availability.

Sort by
h
huaweicloud
国内

TTFT

6.95s

Throughput

31.32tps

Uptime

100.00%

Provider Model

huaweicloud/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 11 PM100.00%
10月9日 7 PM: 99.18%10月9日 7 PM: 98.96%10月9日 8 PM: 99.25%10月9日 8 PM: 100.00%10月9日 9 PM: 100.00%10月9日 9 PM: 99.67%10月9日 10 PM: 100.00%10月9日 10 PM: 100.00%10月9日 11 PM: 98.91%10月9日 11 PM: 99.26%10月10日 8 AM: 100.00%10月10日 9 AM: 100.00%10月10日 9 AM: 99.37%10月10日 10 AM: 100.00%10月10日 10 AM: 99.72%10月10日 11 AM: 98.69%10月10日 11 AM: 99.37%10月10日 12 PM: 99.92%10月10日 12 PM: 100.00%10月10日 1 PM: 100.00%10月10日 1 PM: 99.84%10月10日 2 PM: 99.50%10月10日 2 PM: 99.69%10月10日 3 PM: 99.88%10月10日 3 PM: 100.00%10月10日 4 PM: 100.00%10月10日 4 PM: 99.52%10月10日 5 PM: 100.00%10月10日 5 PM: 100.00%10月10日 6 PM: 100.00%10月10日 6 PM: 99.51%10月10日 7 PM: 100.00%10月10日 7 PM: 99.49%10月10日 8 PM: 100.00%10月10日 8 PM: 99.81%10月10日 9 PM: 99.75%10月10日 9 PM: 99.39%10月10日 10 PM: 100.00%10月10日 10 PM: 100.00%10月10日 11 PM: 99.40%10月10日 11 PM: 100.00%10月11日 8 AM: 100.00%10月11日 9 AM: 100.00%10月11日 9 AM: 100.00%10月11日 10 AM: 99.74%10月11日 10 AM: 99.45%10月11日 11 AM: 99.69%10月11日 11 AM: 100.00%10月11日 12 PM: 100.00%10月11日 12 PM: 100.00%10月11日 1 PM: 100.00%10月11日 1 PM: 99.73%10月11日 2 PM: 98.83%10月11日 2 PM: 100.00%10月11日 3 PM: 100.00%10月11日 3 PM: 100.00%10月11日 4 PM: 100.00%10月11日 4 PM: 100.00%10月11日 5 PM: 100.00%10月11日 5 PM: 100.00%10月11日 6 PM: 100.00%10月11日 6 PM: 100.00%10月11日 7 PM: 100.00%10月11日 7 PM: 100.00%10月11日 8 PM: 100.00%10月11日 8 PM: 100.00%10月11日 9 PM: 100.00%10月11日 9 PM: 100.00%10月11日 10 PM: 100.00%10月11日 10 PM: 100.00%10月11日 11 PM: 100.00%10月11日 11 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsAnthropic Messages

Total Context

1,000,000

Max Output

128,000

Input Price-10%

¥7.2 / 1M tokens

Output Price-10%

¥25.2 / 1M tokens

Cache Write-10%

¥9 / 1M tokens

Cache Read-10%

¥1.8 / 1M tokens

n
nc
国内

TTFT

4.95s

Throughput

33.91tps

Uptime

100.00%

Provider Model

nc/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 11 PM100.00%
10月9日 7 PM: 100.00%10月9日 7 PM: 100.00%10月9日 8 PM: 100.00%10月9日 8 PM: 100.00%10月9日 9 PM: 100.00%10月9日 9 PM: 100.00%10月9日 10 PM: 100.00%10月9日 10 PM: 100.00%10月9日 11 PM: 100.00%10月9日 11 PM: 100.00%10月10日 8 AM: 100.00%10月10日 9 AM: 100.00%10月10日 9 AM: 99.52%10月10日 10 AM: 99.12%10月10日 10 AM: 100.00%10月10日 11 AM: 98.69%10月10日 11 AM: 99.05%10月10日 12 PM: 99.47%10月10日 12 PM: 100.00%10月10日 1 PM: 99.78%10月10日 1 PM: 100.00%10月10日 2 PM: 100.00%10月10日 2 PM: 99.86%10月10日 3 PM: 100.00%10月10日 3 PM: 98.55%10月10日 4 PM: 98.30%10月10日 4 PM: 98.23%10月10日 5 PM: 98.12%10月10日 5 PM: 98.74%10月10日 6 PM: 96.62%10月10日 6 PM: 99.52%10月10日 7 PM: 100.00%10月10日 7 PM: 100.00%10月10日 8 PM: 100.00%10月10日 8 PM: 99.64%10月10日 9 PM: 100.00%10月10日 9 PM: 100.00%10月10日 10 PM: 100.00%10月10日 10 PM: 100.00%10月10日 11 PM: 100.00%10月10日 11 PM: 100.00%10月11日 8 AM: 100.00%10月11日 9 AM: 100.00%10月11日 9 AM: 100.00%10月11日 10 AM: 100.00%10月11日 10 AM: 99.72%10月11日 11 AM: 100.00%10月11日 11 AM: 100.00%10月11日 12 PM: 100.00%10月11日 12 PM: 100.00%10月11日 1 PM: 100.00%10月11日 1 PM: 100.00%10月11日 2 PM: 99.75%10月11日 2 PM: 99.51%10月11日 3 PM: 100.00%10月11日 3 PM: 100.00%10月11日 4 PM: 100.00%10月11日 4 PM: 100.00%10月11日 5 PM: 100.00%10月11日 5 PM: 100.00%10月11日 6 PM: 100.00%10月11日 6 PM: 100.00%10月11日 7 PM: 100.00%10月11日 7 PM: 100.00%10月11日 8 PM: 100.00%10月11日 8 PM: 100.00%10月11日 9 PM: 100.00%10月11日 9 PM: 100.00%10月11日 10 PM: 100.00%10月11日 10 PM: 100.00%10月11日 11 PM: 100.00%10月11日 11 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsAnthropic Messages

Total Context

1,000,000

Max Output

128,000

Input Price-30%

¥5.6 / 1M tokens

Output Price-30%

¥19.6 / 1M tokens

Cache Write-30%

¥7 / 1M tokens

Cache Read-30%

¥1.4 / 1M tokens

p
paratera并行科技
国内

TTFT

5.21s

Throughput

2.16tps

Uptime

43.00%

Provider Model

paratera/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 11 PM42.62%
10月9日 6 PM: 98.68%10月9日 7 PM: 100.00%10月9日 7 PM: 100.00%10月9日 8 PM: 100.00%10月9日 8 PM: 100.00%10月9日 9 PM: 100.00%10月9日 9 PM: 100.00%10月9日 10 PM: 100.00%10月9日 10 PM: 100.00%10月9日 11 PM: 100.00%10月9日 11 PM: 100.00%10月10日 8 AM: 100.00%10月10日 9 AM: 100.00%10月10日 9 AM: 100.00%10月10日 10 AM: 100.00%10月10日 10 AM: 97.78%10月10日 11 AM: 100.00%10月10日 11 AM: 100.00%10月10日 12 PM: 100.00%10月10日 12 PM: 100.00%10月10日 1 PM: 100.00%10月10日 1 PM: 100.00%10月10日 2 PM: 100.00%10月10日 2 PM: 100.00%10月10日 3 PM: 100.00%10月10日 3 PM: 100.00%10月10日 4 PM: 100.00%10月10日 4 PM: 100.00%10月10日 5 PM: 100.00%10月10日 5 PM: 100.00%10月10日 6 PM: 99.87%10月10日 6 PM: 100.00%10月10日 7 PM: 100.00%10月10日 7 PM: 100.00%10月10日 8 PM: 100.00%10月10日 8 PM: 100.00%10月10日 9 PM: 100.00%10月10日 9 PM: 100.00%10月10日 10 PM: 100.00%10月10日 10 PM: 100.00%10月10日 11 PM: 100.00%10月10日 11 PM: 100.00%10月11日 8 AM: 34.88%10月11日 9 AM: 25.81%10月11日 9 AM: 41.67%10月11日 10 AM: 39.13%10月11日 10 AM: 33.93%10月11日 11 AM: 21.57%10月11日 11 AM: 20.41%10月11日 12 PM: 14.29%10月11日 12 PM: 4.55%10月11日 1 PM: 12.20%10月11日 1 PM: 71.79%10月11日 2 PM: 95.12%10月11日 2 PM: 71.43%10月11日 3 PM: 64.76%10月11日 3 PM: 74.29%10月11日 4 PM: 33.33%10月11日 4 PM: 75.00%10月11日 5 PM: 50.00%10月11日 5 PM: 42.86%10月11日 6 PM: 60.00%10月11日 6 PM: 50.00%10月11日 7 PM: 34.09%10月11日 8 PM: 33.33%10月11日 8 PM: 19.05%10月11日 9 PM: 50.00%10月11日 9 PM: 6.25%10月11日 10 PM: 42.25%10月11日 10 PM: 43.24%10月11日 11 PM: 38.46%10月11日 11 PM: 42.62%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat Completions

Total Context

1,000,000

Max Output

128,000

Input Price-20%

¥6.4 / 1M tokens

Output Price-20%

¥22.4 / 1M tokens

Cache Write-20%

¥8 / 1M tokens

Cache Read-20%

¥1.6 / 1M tokens

t
tokenmall-zyld
国内

TTFT

17.02s

Throughput

26.26tps

Uptime

100.00%

Provider Model

tokenmall-zyld/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 11 PM100.00%
10月9日 7 PM: 100.00%10月9日 7 PM: 98.81%10月9日 8 PM: 100.00%10月9日 8 PM: 98.63%10月9日 9 PM: 99.75%10月9日 9 PM: 100.00%10月9日 10 PM: 99.73%10月9日 10 PM: 96.98%10月9日 11 PM: 100.00%10月9日 11 PM: 100.00%10月10日 8 AM: 100.00%10月10日 9 AM: 91.40%10月10日 9 AM: 90.77%10月10日 10 AM: 94.78%10月10日 10 AM: 100.00%10月10日 11 AM: 99.48%10月10日 11 AM: 99.61%10月10日 12 PM: 99.19%10月10日 12 PM: 100.00%10月10日 1 PM: 99.70%10月10日 1 PM: 99.48%10月10日 2 PM: 99.02%10月10日 2 PM: 100.00%10月10日 3 PM: 100.00%10月10日 3 PM: 100.00%10月10日 4 PM: 99.64%10月10日 4 PM: 100.00%10月10日 5 PM: 100.00%10月10日 5 PM: 100.00%10月10日 6 PM: 98.56%10月10日 6 PM: 99.61%10月10日 7 PM: 100.00%10月10日 7 PM: 99.33%10月10日 8 PM: 98.36%10月10日 8 PM: 100.00%10月10日 9 PM: 99.16%10月10日 9 PM: 48.48%10月10日 10 PM: 100.00%10月10日 10 PM: 100.00%10月10日 11 PM: 100.00%10月10日 11 PM: 98.86%10月11日 8 AM: 100.00%10月11日 9 AM: 100.00%10月11日 9 AM: 100.00%10月11日 10 AM: 100.00%10月11日 10 AM: 98.44%10月11日 11 AM: 100.00%10月11日 11 AM: 95.83%10月11日 12 PM: 100.00%10月11日 12 PM: 97.87%10月11日 1 PM: 98.28%10月11日 1 PM: 100.00%10月11日 2 PM: 98.61%10月11日 2 PM: 100.00%10月11日 3 PM: 100.00%10月11日 3 PM: 100.00%10月11日 4 PM: 98.28%10月11日 4 PM: 100.00%10月11日 5 PM: 92.31%10月11日 5 PM: 100.00%10月11日 6 PM: 100.00%10月11日 6 PM: 100.00%10月11日 7 PM: 100.00%10月11日 7 PM: 100.00%10月11日 8 PM: 100.00%10月11日 8 PM: 100.00%10月11日 9 PM: 100.00%10月11日 9 PM: 100.00%10月11日 10 PM: 100.00%10月11日 10 PM: 96.88%10月11日 11 PM: 100.00%10月11日 11 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

Total Context

1,000,000

Max Output

128,000

Input Price-50%

¥4 / 1M tokens

Output Price-50%

¥14 / 1M tokens

Cache Write-50%

¥5 / 1M tokens

Cache Read-50%

¥1 / 1M tokens

智
智谱
国内

TTFT

3.75s

Throughput

39.82tps

Uptime

100.00%

Provider Model

bigmodel/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 11 PM100.00%
10月9日 7 PM: 100.00%10月9日 7 PM: 100.00%10月9日 8 PM: 100.00%10月9日 8 PM: 100.00%10月9日 9 PM: 100.00%10月9日 9 PM: 100.00%10月9日 10 PM: 100.00%10月9日 10 PM: 99.71%10月9日 11 PM: 100.00%10月9日 11 PM: 100.00%10月10日 8 AM: 93.10%10月10日 9 AM: 98.55%10月10日 9 AM: 100.00%10月10日 10 AM: 100.00%10月10日 10 AM: 99.79%10月10日 11 AM: 99.76%10月10日 11 AM: 99.43%10月10日 12 PM: 99.81%10月10日 12 PM: 99.73%10月10日 1 PM: 100.00%10月10日 1 PM: 100.00%10月10日 2 PM: 100.00%10月10日 2 PM: 99.70%10月10日 3 PM: 99.72%10月10日 3 PM: 99.57%10月10日 4 PM: 99.71%10月10日 4 PM: 100.00%10月10日 5 PM: 100.00%10月10日 5 PM: 100.00%10月10日 6 PM: 99.87%10月10日 6 PM: 99.69%10月10日 7 PM: 100.00%10月10日 7 PM: 100.00%10月10日 8 PM: 100.00%10月10日 8 PM: 99.37%10月10日 9 PM: 100.00%10月10日 9 PM: 98.86%10月10日 10 PM: 99.75%10月10日 10 PM: 99.74%10月10日 11 PM: 100.00%10月10日 11 PM: 100.00%10月11日 8 AM: 100.00%10月11日 9 AM: 100.00%10月11日 9 AM: 100.00%10月11日 10 AM: 100.00%10月11日 10 AM: 100.00%10月11日 11 AM: 100.00%10月11日 11 AM: 100.00%10月11日 12 PM: 100.00%10月11日 12 PM: 100.00%10月11日 1 PM: 100.00%10月11日 1 PM: 100.00%10月11日 2 PM: 98.65%10月11日 2 PM: 100.00%10月11日 3 PM: 96.43%10月11日 3 PM: 100.00%10月11日 4 PM: 100.00%10月11日 4 PM: 100.00%10月11日 5 PM: 100.00%10月11日 5 PM: 100.00%10月11日 6 PM: 100.00%10月11日 6 PM: 100.00%10月11日 7 PM: 100.00%10月11日 7 PM: 100.00%10月11日 8 PM: 100.00%10月11日 8 PM: 100.00%10月11日 9 PM: 100.00%10月11日 9 PM: 96.00%10月11日 10 PM: 100.00%10月11日 10 PM: 100.00%10月11日 11 PM: 100.00%10月11日 11 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

Total Context

1,000,000

Max Output

128,000

Input Price-5%

¥7.6 / 1M tokens

Output Price-5%

¥26.6 / 1M tokens

Cache Write-5%

¥9.5 / 1M tokens

Cache Read-5%

¥1.9 / 1M tokens

火
火山引擎
国内

TTFT

4.17s

Throughput

53.48tps

Uptime

100.00%

Provider Model

volcengine/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 10 PM100.00%
No dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo data10月11日 9 PM: 100.00%10月11日 10 PM: 100.00%10月11日 10 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsOpenAI Responses

Total Context

1,000,000

Max Output

128,000

Input Price-10%

¥7.2 / 1M tokens

Output Price-10%

¥25.2 / 1M tokens

Cache Write-10%

¥9 / 1M tokens

Cache Read-10%

¥1.8 / 1M tokens

腾
腾讯混元
国内

TTFT

0.49s

Throughput

0.33tps

Uptime

100.00%

Provider Model

tencent/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月9日 2 AMNo data
No dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo data

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

Total Context

1,000,000

Max Output

128,000

Input Price-5%

¥7.6 / 1M tokens

Output Price-5%

¥26.6 / 1M tokens

Cache Write-5%

¥9.5 / 1M tokens

Cache Read-5%

¥1.9 / 1M tokens

通
通义千问
国内

TTFT

4.06s

Throughput

18.91tps

Uptime

100.00%

Provider Model

alibaba/z-ai/glm-5.3

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 9 PM100.00%
No dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo data10月11日 10 AM: 100.00%10月11日 11 AM: 100.00%10月11日 8 PM: 100.00%10月11日 9 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

Total Context

1,000,000

Max Output

128,000

Input Price

¥8 / 1M tokens

Output Price

¥28 / 1M tokens

Cache Write

¥10 / 1M tokens

Cache Read

¥2 / 1M tokens

Performance for z-ai/glm-5.3

Compare different providers across Zhinao API

Throughput

28.69 tok/s

TTFT

8.14 s

Uptime for z-ai/glm-5.3

Uptime for z-ai/glm-5.3 across all providers

Sample code and API for z-ai/glm-5.3

Get API Key

Zhinao API normalizes requests and responses across providers for you

View full docs
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.360.cn/v1",
  apiKey: process.env.ZHINAO_API_KEY,
});

const response = await client.chat.completions.create({
  model: "z-ai/glm-5.3",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ],
  temperature: 0.7,
  max_tokens: 1000,
});

console.log(response.choices[0].message.content);