360智脑开放平台

让企业用 AI,像用水电一样简单

更多链接
模型广场控制台API Keys用量查询文档
360智脑开放平台. 保留所有权利|隐私政策|服务条款
360智脑开放平台
360智脑开放平台
  • 模型广场
  • 官方文档
  • Playground
G

z-ai/glm-5.3

在线对话
智谱

发布时间

2026/8/14

模型系列

GLM

输入模态

输出模态

输入价格

¥7.6 / 1M tokens

输出价格

¥26.6 / 1M tokens

缓存写入价格

¥9.5 / 1M tokens

缓存读取价格

¥1.9 / 1M tokens

上下文窗口

1,000,000

最大输出长度

128,000

GLM-5.3 是智谱最新旗舰模型,复杂软件工程与 Agent 任务能力全面进阶。它使用与 GLM-5.2 相同的基础模型——所有提升均来自后训练。与 GLM-5.2 相比,它在复杂编程和长程任务方面表现更加出色。 GLM-5.3 目前仅支持处理文本模态信息,支持 1M 上下文窗口,最大输出 Tokens 为 128K。 GLM-5.3 会始终启用思考功能,支持三个思考强度级别:low、high 和 max,并不再支持禁用思考功能。

z-ai/glm-5.3的供应商

智脑 API 根据调度策略向最合适的供应商发起请求,并自动回退至可用性最高的供应商。

排序
智
智谱
国内

首字延迟

3.21s

吞吐量

32.55tps

可用性

99.00%

供应商模型名

bigmodel/z-ai/glm-5.3

支持的参数

temperaturetop_ptop_k

近期可用性

9月2日 11 AM98.95%
8月30日 4 PM: 99.77%8月30日 5 PM: 99.83%8月30日 5 PM: 99.73%8月30日 6 PM: 100.00%8月30日 6 PM: 100.00%8月30日 7 PM: 90.81%8月30日 7 PM: 96.67%8月30日 8 PM: 99.86%8月30日 8 PM: 100.00%8月30日 9 PM: 99.62%8月30日 9 PM: 100.00%8月30日 10 PM: 100.00%8月30日 10 PM: 100.00%8月30日 11 PM: 100.00%8月30日 11 PM: 96.14%8月31日 8 AM: 100.00%8月31日 9 AM: 100.00%8月31日 9 AM: 99.29%8月31日 10 AM: 99.94%8月31日 10 AM: 99.88%8月31日 11 AM: 100.00%8月31日 11 AM: 97.72%8月31日 12 PM: 99.05%8月31日 12 PM: 99.05%8月31日 1 PM: 100.00%8月31日 1 PM: 81.48%8月31日 2 PM: 99.82%8月31日 2 PM: 99.90%8月31日 3 PM: 99.79%8月31日 3 PM: 97.40%8月31日 4 PM: 98.31%8月31日 4 PM: 99.61%8月31日 5 PM: 99.69%8月31日 5 PM: 100.00%8月31日 6 PM: 100.00%8月31日 6 PM: 100.00%8月31日 7 PM: 91.82%8月31日 7 PM: 89.13%8月31日 8 PM: 87.71%8月31日 8 PM: 100.00%8月31日 9 PM: 99.39%8月31日 10 PM: 99.43%8月31日 10 PM: 91.49%8月31日 11 PM: 94.33%9月1日 9 AM: 100.00%9月1日 9 AM: 100.00%9月1日 10 AM: 98.21%9月1日 10 AM: 95.28%9月1日 11 AM: 59.12%9月1日 11 AM: 99.07%9月1日 12 PM: 100.00%9月1日 12 PM: 100.00%9月1日 2 PM: 99.46%9月1日 3 PM: 97.72%9月1日 3 PM: 93.45%9月1日 4 PM: 92.82%9月1日 4 PM: 90.59%9月1日 5 PM: 85.71%9月1日 5 PM: 92.31%9月1日 6 PM: 86.07%9月1日 6 PM: 94.67%9月1日 7 PM: 100.00%9月1日 10 PM: 100.00%9月1日 10 PM: 99.71%9月1日 11 PM: 100.00%9月1日 11 PM: 99.90%9月2日 8 AM: 100.00%9月2日 9 AM: 100.00%9月2日 9 AM: 100.00%9月2日 10 AM: 95.90%9月2日 10 AM: 99.55%9月2日 11 AM: 98.95%

推理

可切换推理

支持的响应格式

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

上下文长度

1,000,000

最大输出

128,000

输入价格

¥7.6 / 1M tokens

输出价格

¥26.6 / 1M tokens

缓存写入

¥9.5 / 1M tokens

缓存读取

¥1.9 / 1M tokens

腾
腾讯混元
国内

首字延迟

3.72s

吞吐量

32.75tps

可用性

98.00%

供应商模型名

tencent/z-ai/glm-5.3

支持的参数

temperaturetop_ptop_k

近期可用性

9月2日 11 AM98.19%
8月30日 4 PM: 100.00%8月30日 5 PM: 99.83%8月30日 5 PM: 100.00%8月30日 6 PM: 100.00%8月30日 6 PM: 100.00%8月30日 7 PM: 100.00%8月30日 7 PM: 100.00%8月30日 8 PM: 99.83%8月30日 8 PM: 100.00%8月30日 9 PM: 100.00%8月30日 9 PM: 100.00%8月30日 10 PM: 99.82%8月30日 10 PM: 100.00%8月30日 11 PM: 99.82%8月30日 11 PM: 100.00%8月31日 8 AM: 100.00%8月31日 9 AM: 100.00%8月31日 9 AM: 99.94%8月31日 10 AM: 99.94%8月31日 10 AM: 100.00%8月31日 11 AM: 99.90%8月31日 11 AM: 98.55%8月31日 12 PM: 99.01%8月31日 12 PM: 99.09%8月31日 1 PM: 100.00%8月31日 1 PM: 100.00%8月31日 2 PM: 100.00%8月31日 2 PM: 98.08%8月31日 3 PM: 95.72%8月31日 3 PM: 91.87%8月31日 4 PM: 94.14%8月31日 4 PM: 96.81%8月31日 5 PM: 95.09%8月31日 5 PM: 98.22%8月31日 6 PM: 100.00%8月31日 6 PM: 99.70%8月31日 7 PM: 96.35%8月31日 7 PM: 97.50%8月31日 8 PM: 100.00%8月31日 8 PM: 98.91%8月31日 9 PM: 99.38%8月31日 10 PM: 99.55%8月31日 10 PM: 99.29%8月31日 11 PM: 98.93%9月1日 9 AM: 100.00%9月1日 9 AM: 100.00%9月1日 10 AM: 100.00%9月1日 10 AM: 98.16%9月1日 11 AM: 94.40%9月1日 11 AM: 97.49%9月1日 12 PM: 94.53%9月1日 12 PM: 99.76%9月1日 2 PM: 100.00%9月1日 3 PM: 98.45%9月1日 3 PM: 95.38%9月1日 4 PM: 97.29%9月1日 4 PM: 92.85%9月1日 5 PM: 96.10%9月1日 5 PM: 95.76%9月1日 6 PM: 97.41%9月1日 6 PM: 97.42%9月1日 7 PM: 89.86%9月1日 10 PM: 100.00%9月1日 10 PM: 99.86%9月1日 11 PM: 100.00%9月1日 11 PM: 100.00%9月2日 8 AM: 100.00%9月2日 9 AM: 100.00%9月2日 9 AM: 100.00%9月2日 10 AM: 93.06%9月2日 10 AM: 96.23%9月2日 11 AM: 98.19%

推理

可切换推理

支持的响应格式

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

上下文长度

1,000,000

最大输出

128,000

输入价格

¥7.6 / 1M tokens

输出价格

¥26.6 / 1M tokens

缓存写入

¥9.5 / 1M tokens

缓存读取

¥1.9 / 1M tokens

z-ai/glm-5.3的性能

在智脑 API 上对比不同供应商的表现

吞吐量

33.37 tok/s

首字延迟

4.08 s

z-ai/glm-5.3的可用性

z-ai/glm-5.3的各供应商可用性

z-ai/glm-5.3示例代码与 API

获取 API Key

智脑 API 为您统一各供应商的请求与响应格式

查看完整文档
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.360.cn/v1",
  apiKey: process.env.ZHINAO_API_KEY,
});

const response = await client.chat.completions.create({
  model: "z-ai/glm-5.3",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ],
  temperature: 0.7,
  max_tokens: 1000,
});

console.log(response.choices[0].message.content);