360智脑开放平台

让企业用 AI,像用水电一样简单

更多链接
模型广场控制台API Keys用量查询文档
360智脑开放平台. 保留所有权利|隐私政策|服务条款
360智脑开放平台
360智脑开放平台
  • 模型广场
  • API 文档
K

moonshotai/kimi-k2.5

在线对话
月之暗面

发布时间

2026/1/27

模型系列

Kimi

输入模态

输出模态

输入价格

¥0 / 1M tokens

输出价格

¥0 / 1M tokens

缓存写入价格

¥0 / 1M tokens

缓存读取价格

¥0 / 1M tokens

上下文窗口

262,144

最大输出长度

32,768

kimi-k2.5 是 Kimi 迄今最全能的模型,原生的多模态架构设计,同时支持视觉与文本输入、思考与非思考模式、对话与 Agent 任务 模型上下文长度 256k,支持长思考擅长深度推理 支持自动上下文缓存功能,ToolCalls、JSON Mode、Partial Mode、联网搜索功能等能力

moonshotai/kimi-k2.5的供应商

智脑 API 根据调度策略向最合适的供应商发起请求,并自动回退至可用性最高的供应商。

排序
t
tokenmall-jdy
国内

首字延迟

0.28s

吞吐量

24.09tps

可用性

100.00%

供应商模型名

jdcloud/moonshotai/kimi-k2.5

支持的参数

temperaturetop_ptop_k

近期可用性

8月12日 8 PM100.00%
暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据8月10日 9 AM: 100.00%8月10日 10 AM: 100.00%8月10日 9 PM: 100.00%8月12日 11 AM: 100.00%8月12日 4 PM: 100.00%8月12日 4 PM: 100.00%8月12日 5 PM: 100.00%8月12日 5 PM: 100.00%8月12日 6 PM: 100.00%8月12日 6 PM: 100.00%8月12日 7 PM: 100.00%8月12日 7 PM: 100.00%8月12日 8 PM: 100.00%

推理

可切换推理

支持的响应格式

OpenAI Chat Completions

请求日志收集

支持 ZDR

可用于蒸馏

是

上下文长度

262,144

最大输出

65,500

输入价格

¥3.2 / 1M tokens

输出价格

¥16.8 / 1M tokens

缓存写入

¥4 / 1M tokens

缓存读取

¥0.56 / 1M tokens

七
七牛云
国内

首字延迟

0.07s

吞吐量

31.73tps

可用性

100.00%

供应商模型名

qiniu/kimi-k2.5

支持的参数

temperaturetop_ptop_k

近期可用性

8月12日 8 PM100.00%
暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据8月10日 10 AM: 100.00%8月10日 8 PM: 100.00%8月11日 6 PM: 97.56%8月11日 7 PM: 100.00%8月12日 10 AM: 100.00%8月12日 11 AM: 100.00%8月12日 11 AM: 100.00%8月12日 12 PM: 100.00%8月12日 3 PM: 100.00%8月12日 4 PM: 100.00%8月12日 4 PM: 100.00%8月12日 5 PM: 100.00%8月12日 5 PM: 100.00%8月12日 6 PM: 100.00%8月12日 6 PM: 100.00%8月12日 7 PM: 100.00%8月12日 7 PM: 100.00%8月12日 8 PM: 100.00%

推理

可切换推理

支持的响应格式

OpenAI Chat Completions

请求日志收集

支持 ZDR

可用于蒸馏

是

上下文长度

262,000

最大输出

262,000

输入价格

¥4 / 1M tokens

输出价格

¥21 / 1M tokens

缓存写入

¥5 / 1M tokens

缓存读取

¥0.7 / 1M tokens

月
月之暗面
国内

首字延迟

0.81s

吞吐量

25.20tps

可用性

94.00%

供应商模型名

moonshot/moonshot/kimi-k2.5

支持的参数

temperaturetop_ptop_k

近期可用性

8月12日 8 PM93.94%
暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据暂无数据8月10日 9 AM: 100.00%8月12日 4 PM: 93.55%8月12日 4 PM: 96.45%8月12日 5 PM: 98.26%8月12日 5 PM: 95.30%8月12日 6 PM: 97.11%8月12日 6 PM: 99.65%8月12日 7 PM: 95.91%8月12日 7 PM: 98.15%8月12日 8 PM: 93.94%

推理

可切换推理

支持的响应格式

Anthropic MessagesOpenAI Chat Completions

请求日志收集

支持 ZDR

可用于蒸馏

是

上下文长度

262,144

最大输出

65,500

输入价格

¥4 / 1M tokens

输出价格

¥21 / 1M tokens

缓存写入

¥5 / 1M tokens

缓存读取

¥0.7 / 1M tokens

moonshotai/kimi-k2.5的性能

在智脑 API 上对比不同供应商的表现

吞吐量

23.87 tok/s

首字延迟

0.73 s

moonshotai/kimi-k2.5的可用性

moonshotai/kimi-k2.5的各供应商可用性

moonshotai/kimi-k2.5示例代码与 API

获取 API Key

智脑 API 为您统一各供应商的请求与响应格式

查看完整文档
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.360.cn/v1",
  apiKey: process.env.ZHINAO_API_KEY,
});

const response = await client.chat.completions.create({
  model: "moonshotai/kimi-k2.5",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ],
  temperature: 0.7,
  max_tokens: 1000,
});

console.log(response.choices[0].message.content);