360智脑开放平台

让企业用 AI,像用水电一样简单

更多链接
模型广场控制台API Keys用量查询文档
360智脑开放平台. 保留所有权利|隐私政策|服务条款
360智脑开放平台
360智脑开放平台
  • 模型广场
  • 官方文档
  • Playground
千

qwen/qwen3.8-flash

在线对话
阿里巴巴

发布时间

2026/8/27

模型系列

千问

输入模态

输出模态

输入价格

¥1 / 1M tokens

输出价格

¥3 / 1M tokens

缓存写入价格

¥1.25 / 1M tokens

缓存读取价格

¥0.1 / 1M tokens

上下文窗口

1,000,000

最大输出长度

128,000

Qwen3.8-Flash 是千问最新推出的多模态大模型,兼具强大的理解与生成能力和出色的响应速度。模型原生支持百万级上下文窗口,能够一次性处理超长文档、代码仓库和复杂对话。在编程辅助、智能体协作、图文理解等场景中表现尤为出色——无论是自动修复代码、操作桌面应用,还是分析图表与长视频,都能给出准确、高质量的结果。同时兼容 OpenAI 与 Anthropic 主流接口协议,可无缝接入 Claude Code、Codex 等开发者工具,轻松构建高并发应用与智能工作流。凭借优异的性能与极具竞争力的推理成本,Qwen3.8-Flash 是开发者和企业在 AI 应用中兼顾效果与效率的理想选择。

qwen/qwen3.8-flash的供应商

智脑 API 根据调度策略向最合适的供应商发起请求,并自动回退至可用性最高的供应商。

排序
通
通义千问
国内

首字延迟

6.17s

吞吐量

56.42tps

可用性

98.00%

供应商模型名

alibaba/qwen/qwen3.8-flash

支持的参数

temperaturetop_ptop_k

近期可用性

9月2日 11 AM97.76%
8月30日 5 PM: 100.00%8月30日 5 PM: 100.00%8月30日 6 PM: 100.00%8月30日 6 PM: 100.00%8月30日 7 PM: 100.00%8月30日 7 PM: 100.00%8月30日 8 PM: 71.43%8月30日 8 PM: 100.00%8月30日 9 PM: 100.00%8月30日 9 PM: 100.00%8月30日 10 PM: 100.00%8月30日 10 PM: 100.00%8月30日 11 PM: 100.00%8月30日 11 PM: 100.00%8月31日 8 AM: 100.00%8月31日 9 AM: 100.00%8月31日 9 AM: 100.00%8月31日 10 AM: 93.85%8月31日 10 AM: 97.33%8月31日 11 AM: 96.51%8月31日 11 AM: 95.56%8月31日 12 PM: 100.00%8月31日 12 PM: 99.70%8月31日 1 PM: 99.81%8月31日 1 PM: 99.33%8月31日 2 PM: 100.00%8月31日 2 PM: 99.70%8月31日 3 PM: 100.00%8月31日 3 PM: 99.89%8月31日 4 PM: 99.70%8月31日 4 PM: 97.23%8月31日 5 PM: 99.69%8月31日 5 PM: 100.00%8月31日 6 PM: 99.35%8月31日 6 PM: 99.68%8月31日 7 PM: 100.00%8月31日 7 PM: 100.00%8月31日 8 PM: 100.00%8月31日 8 PM: 99.75%8月31日 9 PM: 100.00%8月31日 10 PM: 100.00%8月31日 10 PM: 100.00%8月31日 11 PM: 100.00%9月1日 8 AM: 100.00%9月1日 9 AM: 100.00%9月1日 9 AM: 100.00%9月1日 10 AM: 100.00%9月1日 10 AM: 100.00%9月1日 11 AM: 99.83%9月1日 11 AM: 100.00%9月1日 12 PM: 99.84%9月1日 12 PM: 100.00%9月1日 2 PM: 100.00%9月1日 3 PM: 91.69%9月1日 3 PM: 100.00%9月1日 4 PM: 100.00%9月1日 4 PM: 100.00%9月1日 5 PM: 97.35%9月1日 5 PM: 99.14%9月1日 6 PM: 99.78%9月1日 6 PM: 99.82%9月1日 7 PM: 100.00%9月1日 10 PM: 99.91%9月1日 10 PM: 99.83%9月1日 11 PM: 100.00%9月1日 11 PM: 100.00%9月2日 8 AM: 100.00%9月2日 9 AM: 100.00%9月2日 9 AM: 100.00%9月2日 10 AM: 100.00%9月2日 10 AM: 100.00%9月2日 11 AM: 97.76%

推理

可切换推理

支持的响应格式

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

上下文长度

1,000,000

最大输出

128,000

输入价格

¥1 / 1M tokens

输出价格

¥3 / 1M tokens

缓存写入

¥1.25 / 1M tokens

缓存读取

¥0.1 / 1M tokens

qwen/qwen3.8-flash的性能

在智脑 API 上对比不同供应商的表现

吞吐量

56.01 tok/s

首字延迟

6.13 s

qwen/qwen3.8-flash的可用性

qwen/qwen3.8-flash的各供应商可用性

qwen/qwen3.8-flash示例代码与 API

获取 API Key

智脑 API 为您统一各供应商的请求与响应格式

查看完整文档
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.360.cn/v1",
  apiKey: process.env.ZHINAO_API_KEY,
});

const response = await client.chat.completions.create({
  model: "qwen/qwen3.8-flash",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ],
  temperature: 0.7,
  max_tokens: 1000,
});

console.log(response.choices[0].message.content);