360智脑开放平台

让企业用 AI,像用水电一样简单

更多链接
模型广场控制台API Keys用量查询文档
360智脑开放平台. 保留所有权利|隐私政策|服务条款
360智脑开放平台
360智脑开放平台
  • 模型广场
  • 官方文档
  • Playground
M

minimax/MiniMax-M3

在线对话
MiniMax

发布时间

2026/5/31

模型系列

MiniMax

输入模态

输出模态

输入价格

¥2.1 / 1M tokens

输出价格

¥8.4 / 1M tokens

缓存写入价格

¥2.625 / 1M tokens

缓存读取价格

¥0.42 / 1M tokens

上下文窗口

512,000

最大输出长度

128,000

MiniMax-M3 是 MiniMax 推出的多模态基础模型。它支持文本、图像和视频输入,并输出文本,拥有 1M 的上下文窗口,适用于长时间的智能体工作、编码和工具使用。该模型基于 MiniMax 稀疏注意力机制 (MSA) 构建,MSA 用键值块选择取代了完整的注意力机制,从而在长时间上下文中大幅降低每个词元的计算量——在 1M 个token的情况下,其计算成本约为上一代模型的 1/20,同时显著加快了预填充和解码速度,并在大多数任务中保持了质量。 该模型在交错数据上作为原生多模态模型进行训练,并通过交互式用户模拟器框架针对多轮次、类似生产环境的协作进行了调优,因此更适合持续的多步骤任务,而非单轮执行。

minimax/MiniMax-M3的供应商

智脑 API 根据调度策略向最合适的供应商发起请求,并自动回退至可用性最高的供应商。

排序
M
MiniMax
国内

首字延迟

2.61s

吞吐量

19.23tps

可用性

100.00%

供应商模型名

minimax/minimax/MiniMax-M3

支持的参数

temperaturetop_ptop_k

近期可用性

9月3日 1 PM100.00%
8月31日 6 PM: 98.82%8月31日 7 PM: 99.54%8月31日 7 PM: 100.00%8月31日 8 PM: 99.63%8月31日 8 PM: 99.16%8月31日 9 PM: 100.00%8月31日 10 PM: 100.00%8月31日 10 PM: 99.67%8月31日 11 PM: 100.00%9月1日 9 AM: 100.00%9月1日 9 AM: 100.00%9月1日 10 AM: 99.83%9月1日 10 AM: 99.66%9月1日 11 AM: 99.72%9月1日 11 AM: 99.85%9月1日 12 PM: 99.23%9月1日 12 PM: 100.00%9月1日 2 PM: 99.52%9月1日 3 PM: 100.00%9月1日 3 PM: 99.85%9月1日 4 PM: 99.88%9月1日 4 PM: 99.70%9月1日 5 PM: 99.58%9月1日 5 PM: 99.83%9月1日 6 PM: 100.00%9月1日 6 PM: 100.00%9月1日 7 PM: 98.92%9月1日 10 PM: 98.79%9月1日 10 PM: 99.25%9月1日 11 PM: 98.73%9月1日 11 PM: 100.00%9月2日 8 AM: 99.11%9月2日 9 AM: 100.00%9月2日 9 AM: 100.00%9月2日 10 AM: 99.84%9月2日 10 AM: 99.86%9月2日 11 AM: 99.69%9月2日 11 AM: 99.88%9月2日 12 PM: 99.17%9月2日 12 PM: 98.87%9月2日 1 PM: 99.52%9月2日 1 PM: 99.19%9月2日 2 PM: 100.00%9月2日 2 PM: 100.00%9月2日 3 PM: 98.91%9月2日 3 PM: 99.20%9月2日 4 PM: 99.60%9月2日 4 PM: 99.86%9月2日 5 PM: 99.87%9月2日 5 PM: 100.00%9月2日 6 PM: 100.00%9月2日 6 PM: 99.78%9月2日 7 PM: 99.66%9月2日 7 PM: 100.00%9月2日 8 PM: 99.32%9月2日 8 PM: 100.00%9月2日 9 PM: 99.27%9月2日 9 PM: 100.00%9月2日 10 PM: 100.00%9月2日 10 PM: 100.00%9月2日 11 PM: 100.00%9月2日 11 PM: 100.00%9月3日 8 AM: 99.64%9月3日 9 AM: 100.00%9月3日 9 AM: 99.85%9月3日 10 AM: 100.00%9月3日 10 AM: 99.70%9月3日 11 AM: 100.00%9月3日 11 AM: 100.00%9月3日 12 PM: 99.67%9月3日 12 PM: 100.00%9月3日 1 PM: 100.00%

推理

可切换推理

支持的响应格式

OpenAI Chat CompletionsAnthropic MessagesOpenAI Responses

上下文长度

512,000

最大输出

128,000

输入价格

¥2.1 / 1M tokens

输出价格

¥8.4 / 1M tokens

缓存写入

¥2.625 / 1M tokens

缓存读取

¥0.42 / 1M tokens

t
tokenmall-cdtx
国内

首字延迟

42.84s

吞吐量

38.11tps

可用性

100.00%

供应商模型名

tokenmall-cdtx/minimax/MiniMax-M3

支持的参数

temperaturetop_ptop_k

近期可用性

9月3日 1 PM99.52%
8月31日 6 PM: 100.00%8月31日 7 PM: 99.80%8月31日 7 PM: 100.00%8月31日 8 PM: 100.00%8月31日 8 PM: 100.00%8月31日 9 PM: 100.00%8月31日 10 PM: 100.00%8月31日 10 PM: 100.00%8月31日 11 PM: 100.00%9月1日 9 AM: 100.00%9月1日 9 AM: 99.81%9月1日 10 AM: 100.00%9月1日 10 AM: 99.85%9月1日 11 AM: 98.86%9月1日 11 AM: 100.00%9月1日 12 PM: 98.67%9月1日 12 PM: 100.00%9月1日 2 PM: 100.00%9月1日 3 PM: 99.35%9月1日 3 PM: 93.75%9月1日 4 PM: 100.00%9月1日 4 PM: 99.36%9月1日 5 PM: 97.96%9月1日 5 PM: 99.47%9月1日 6 PM: 96.74%9月1日 6 PM: 100.00%9月1日 7 PM: 95.00%9月1日 10 PM: 97.26%9月1日 10 PM: 97.78%9月1日 11 PM: 100.00%9月1日 11 PM: 100.00%9月2日 8 AM: 100.00%9月2日 9 AM: 99.80%9月2日 9 AM: 99.59%9月2日 10 AM: 98.51%9月2日 10 AM: 99.50%9月2日 11 AM: 99.15%9月2日 11 AM: 99.90%9月2日 12 PM: 99.59%9月2日 12 PM: 100.00%9月2日 1 PM: 99.76%9月2日 1 PM: 99.66%9月2日 2 PM: 100.00%9月2日 2 PM: 99.51%9月2日 3 PM: 97.50%9月2日 3 PM: 89.87%9月2日 4 PM: 100.00%9月2日 4 PM: 98.91%9月2日 5 PM: 99.17%9月2日 5 PM: 99.53%9月2日 6 PM: 97.89%9月2日 6 PM: 47.22%9月2日 7 PM: 86.67%9月2日 7 PM: 99.65%9月2日 8 PM: 100.00%9月2日 8 PM: 89.29%9月2日 9 PM: 92.59%9月2日 9 PM: 95.56%9月2日 10 PM: 97.01%9月2日 10 PM: 97.83%9月2日 11 PM: 76.92%9月2日 11 PM: 100.00%9月3日 8 AM: 100.00%9月3日 9 AM: 99.40%9月3日 9 AM: 100.00%9月3日 10 AM: 99.14%9月3日 10 AM: 99.36%9月3日 11 AM: 100.00%9月3日 11 AM: 100.00%9月3日 12 PM: 99.29%9月3日 12 PM: 93.33%9月3日 1 PM: 99.52%

推理

可切换推理

支持的响应格式

OpenAI Chat Completions

上下文长度

512,000

最大输出

128,000

输入价格

¥1.26 / 1M tokens

输出价格

¥5.04 / 1M tokens

缓存写入

¥1.575 / 1M tokens

缓存读取

¥0.126 / 1M tokens

minimax/MiniMax-M3的性能

在智脑 API 上对比不同供应商的表现

吞吐量

35.98 tok/s

首字延迟

4.45 s

minimax/MiniMax-M3的可用性

minimax/MiniMax-M3的各供应商可用性

minimax/MiniMax-M3示例代码与 API

获取 API Key

智脑 API 为您统一各供应商的请求与响应格式

查看完整文档
import OpenAI from "openai";

const client = new OpenAI({
  baseURL: "https://api.360.cn/v1",
  apiKey: process.env.ZHINAO_API_KEY,
});

const response = await client.chat.completions.create({
  model: "minimax/MiniMax-M3",
  messages: [
    { role: "user", content: "Hello, how are you?" }
  ],
  temperature: 0.7,
  max_tokens: 1000,
});

console.log(response.choices[0].message.content);