发布时间
2026/9/21模型系列
MiMo输入模态
输出模态
输入价格
¥1 / 1M tokens输出价格
¥2 / 1M tokens缓存写入价格
¥1.25 / 1M tokens缓存读取价格
¥0.02 / 1M tokens上下文窗口
1,000,000最大输出长度
128,000MiMo-V2.6-Flash 是由小米开发的开源基础模型。该模型基于“混合专家”(Mixture-of-Experts)架构构建,总参数量达 3090 亿,每个 Token 激活参数量为 150 亿,并采用混合注意力机制以提升计算效率。它具备 100 万 Token 的上下文窗口及原生多模态能力。该模型针对智能体(Agent)工作流进行了优化,在编程、视觉、通用及研究等场景下表现出色,尤其擅长处理复杂的长程任务,并在多种智能体框架下展现出强大的泛化能力。
智脑 API 根据调度策略向最合适的供应商发起请求,并自动回退至可用性最高的供应商。
首字延迟
5.05s
吞吐量
19.14tps
可用性
100.00%
供应商模型名
openrouter/xiaomi/mimo-v2.6-flash
支持的参数
近期可用性
推理
可切换推理
支持的响应格式
上下文长度
1,000,000
最大输出
128,000
输入价格
¥1 / 1M tokens
输出价格
¥2 / 1M tokens
缓存写入
¥1.25 / 1M tokens
缓存读取
¥0.02 / 1M tokens
在智脑 API 上对比不同供应商的表现
19.09 tok/s
5.05 s
xiaomi/mimo-v2.6-flash的各供应商可用性
智脑 API 为您统一各供应商的请求与响应格式
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.360.cn/v1",
apiKey: process.env.ZHINAO_API_KEY,
});
const response = await client.responses.create({
model: "xiaomi/mimo-v2.6-flash",
input: "Tell me a three sentence bedtime story about a unicorn.",
});
console.log(response.output_text);