SmartBrain API

Enterprise AI as Simple as Utilities

More Links
Model HubConsoleAPI KeysUsage QueryDocs
SmartBrain API. All rights reserved|Privacy Policy|Terms
SmartBrain API
SmartBrain API
  • Model Hub
  • Official Docs
  • Playground
千

qwen3-32b

Online Chat

Publish time

-

Model Series

千问

Input type

Output type

Input Price

¥2 / 1M tokens

Output Price

¥20 / 1M tokens

Cache Write Price

¥2.5 / 1M tokens

Cache Read Price

¥0.2 / 1M tokens

Context Window

128,000

Max Output Length

31,000

实现思考模式和非思考模式的有效融合,可在对话中切换模式。推理能力显著超过QwQ、通用能力显著超过Qwen2.5-32B-Instruct,达到同规模业界SOTA水平。

Providers for qwen3-32b

Zhinao API routes requests to the best-fit provider and automatically fails over to the one with highest availability.

Sort by
h
huaweicloud
国内

TTFT

No data

Throughput

44.18tps

Uptime

100.00%

Provider Model

huaweicloud/qwen/qwen3-32b

Supported Parameters

temperaturetop_ptop_k

Recent Uptime

10月11日 7 PM100.00%
No dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo data10月9日 11 AM: 100.00%10月9日 2 PM: 100.00%10月9日 3 PM: 100.00%10月9日 3 PM: 100.00%10月9日 4 PM: 100.00%10月9日 5 PM: 100.00%10月9日 9 PM: 100.00%10月9日 9 PM: 100.00%10月10日 1 PM: 100.00%10月10日 2 PM: 100.00%10月10日 3 PM: 100.00%10月10日 4 PM: 100.00%10月10日 7 PM: 100.00%10月11日 1 PM: 100.00%10月11日 7 PM: 100.00%

Reasoning

Toggleable

Supported Response Formats

OpenAI Chat Completions

Total Context

128,000

Max Output

8,000

Input Price-47%

¥1.06 / 1M tokens

Output Price-47%

¥10.6 / 1M tokens

Cache Write-47%

¥1.325 / 1M tokens

Cache Read-47%

¥0.106 / 1M tokens

七
七牛云
国内

TTFT

0.02s

Throughput

70.28tps

Uptime

100.00%

Provider Model

qiniu/qwen3-32b

Supported Parameters

Recent Uptime

10月11日 10 PM100.00%
No data10月9日 10 AM: 100.00%10月9日 11 AM: 100.00%10月9日 11 AM: 100.00%10月9日 12 PM: 100.00%10月9日 12 PM: 100.00%10月9日 1 PM: 100.00%10月9日 2 PM: 100.00%10月9日 2 PM: 100.00%10月9日 3 PM: 100.00%10月9日 3 PM: 100.00%10月9日 4 PM: 100.00%10月9日 4 PM: 100.00%10月9日 5 PM: 100.00%10月9日 5 PM: 100.00%10月9日 6 PM: 100.00%10月9日 6 PM: 100.00%10月9日 7 PM: 100.00%10月9日 7 PM: 100.00%10月9日 8 PM: 100.00%10月9日 8 PM: 100.00%10月9日 9 PM: 100.00%10月9日 9 PM: 100.00%10月9日 10 PM: 100.00%10月9日 10 PM: 100.00%10月9日 11 PM: 100.00%10月9日 11 PM: 100.00%10月10日 10 AM: 100.00%10月10日 11 AM: 100.00%10月10日 11 AM: 100.00%10月10日 12 PM: 100.00%10月10日 12 PM: 100.00%10月10日 1 PM: 100.00%10月10日 1 PM: 100.00%10月10日 2 PM: 100.00%10月10日 2 PM: 100.00%10月10日 3 PM: 100.00%10月10日 3 PM: 100.00%10月10日 4 PM: 100.00%10月10日 4 PM: 100.00%10月10日 5 PM: 100.00%10月10日 5 PM: 100.00%10月10日 6 PM: 100.00%10月10日 6 PM: 100.00%10月10日 7 PM: 100.00%10月10日 7 PM: 100.00%10月10日 8 PM: 100.00%10月10日 8 PM: 100.00%10月10日 9 PM: 100.00%10月10日 9 PM: 100.00%10月10日 10 PM: 100.00%10月10日 10 PM: 100.00%10月10日 11 PM: 100.00%10月10日 11 PM: 100.00%10月11日 9 AM: 100.00%10月11日 9 AM: 100.00%10月11日 10 AM: 100.00%10月11日 10 AM: 100.00%10月11日 11 AM: 100.00%10月11日 11 AM: 100.00%10月11日 2 PM: 100.00%10月11日 2 PM: 100.00%10月11日 4 PM: 100.00%10月11日 5 PM: 100.00%10月11日 5 PM: 100.00%10月11日 6 PM: 100.00%10月11日 6 PM: 100.00%10月11日 7 PM: 100.00%10月11日 7 PM: 100.00%10月11日 8 PM: 100.00%10月11日 9 PM: 100.00%10月11日 10 PM: 100.00%

Reasoning

-

Supported Response Formats

OpenAI Chat CompletionsOpenAI ResponsesAnthropic MessagesOpenAI Chat Completions (Compatible)OpenAI Responses (Compatible)Anthropic Messages (Compatible)SystemOne (Jev)

Total Context

65,536

Max Output

31,000

Input Price

¥2 / 1M tokens

Output Price

¥20 / 1M tokens

Cache Write

¥2.5 / 1M tokens

Cache Read

¥0.2 / 1M tokens

通
通义千问
国内

TTFT

No data

Throughput

37tps

Uptime

100.00%

Provider Model

alibaba/qwen3-32b

Supported Parameters

Recent Uptime

10月9日 6 PM100.00%
No dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo dataNo data10月9日 6 PM: 100.00%

Reasoning

-

Supported Response Formats

OpenAI Chat CompletionsOpenAI ResponsesAnthropic MessagesOpenAI Chat Completions (Compatible)OpenAI Responses (Compatible)Anthropic Messages (Compatible)SystemOne (Jev)

Total Context

65,536

Max Output

31,000

Input Price

¥2 / 1M tokens

Output Price

¥20 / 1M tokens

Cache Write

¥2.5 / 1M tokens

Cache Read

¥0.2 / 1M tokens

Performance for qwen3-32b

Compare different providers across Zhinao API

Throughput

65.47 tok/s

TTFT

0.03 s

Uptime for qwen3-32b

Uptime for qwen3-32b across all providers

Sample code and API for qwen3-32b

Get API Key

Zhinao API normalizes requests and responses across providers for you

View full docs
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.360.cn/v1",
  apiKey: process.env.ZHINAO_API_KEY,
});

const response = await client.chat.completions.create({
  model: "qwen3-32b",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ],
  temperature: 0.7,
  max_tokens: 1000,
});

console.log(response.choices[0].message.content);