模型简介
MiniMax M3 是 MiniMax 面向百万级上下文、代理与办公自动化的新一代模型,采用稀疏注意力降低长上下文计算成本。
模型能力
规格来自已列明的模型资料;目录标签用于快速判断接入能力,精确限制以来源文档为准。
已核验规格
- 官方定位
- 长上下文代理与办公模型
- 上下文窗口
- 1,000,000 tokens
- 核心架构
- MiniMax Sparse Attention
- 重点场景
- 代理、文档、表格、演示文稿
资料来源: B.AI MiniMax M3 模型指南
模型价格和接入方式
价格直接读取 MoleAPI 控制台目录,并按当前计费分组与上下文档位展示。
实际结算价格以控制台中的账户分组为准。
实时价格来源
价格表
USD / 1M tokens标准x1default输入 $0.3 · 输出 $1.2
输入
$0.3 / 1M tokens
输出
$1.2 / 1M tokens
缓存读取
$0.06 / 1M tokens
特价x0.8discount输入 $0.24 · 输出 $0.96
输入
$0.24 / 1M tokens
输出
$0.96 / 1M tokens
缓存读取
$0.048 / 1M tokens
转接x0.3relay输入 $0.09 · 输出 $0.36
输入
$0.09 / 1M tokens
输出
$0.36 / 1M tokens
缓存读取
$0.018 / 1M tokens
接入协议
可用计费分组: 标准, 特价, 转接
- openai
- POST
- /v1/chat/completions
- openai-response
- POST
- /v1/responses
- anthropic
- POST
- /v1/messages
- gemini
- POST
- /v1beta/models/{model}:generateContent
完整模型指南
基于厂商资料整理,并经过独立审稿。 · 2026-07-28
MiniMax M3 是 MiniMax 面向编程与智能体任务的前沿语言模型,采用 MiniMax Sparse Attention(MSA)架构,并提供 100 万 token 上下文窗口。 [6]
模型定位与核心能力
MiniMax 将 M3 定位为面向编程和智能体工作流的模型,重点覆盖超长上下文处理。 [6]
MSA 是其核心注意力架构,旨在降低百万 token 上下文下的注意力计算成本。 [1]
MSA 使用两阶段、基于 GQA 的稀疏注意力机制:索引分支选择相关 KV 块,稀疏分支仅对选中的块执行注意力计算。 [1] 该设计面向长上下文推理效率,并服务于大型代码库理解、多文档处理和长任务上下文。 [1]
能力与规格
M3 的官方上下文窗口为 100 万 token,属于 MiniMax 面向长上下文任务的语言模型。 [6]
| 规格 | 信息 |
|---|---|
| 模型定位 | 编程与智能体模型 [6] |
| 上下文窗口 | 1,000,000 token [6] |
| 核心架构 | MiniMax Sparse Attention(MSA) [6] |
| 长上下文机制 | 基于 GQA 的两阶段稀疏注意力 [1] |
B.AI 的模型文档将 M3 描述为支持文本工作流、函数调用和智能体工作流的平台模型。 [1] 图像输入是否可用取决于具体平台的发布进度和模型配置。 [1]
使用场景
M3 面向需要处理大规模上下文的编程、分析和智能体任务。 [6]
其适用工作负载包括多文档分析、长对话历史处理和大型代码库理解。 [1]
结合工具使用、推理和长上下文状态的智能体工作流是该模型的目标场景之一。 [1] 办公自动化场景包括文档、电子表格和演示文稿的处理或生成。 [1]
重要限制
M3 的部分能力由部署平台和模型配置决定,图像输入并非所有平台配置下均可用。 [1]
最终可用性、模型限额和基准信息可能随发布进度更新。 [1]
来源
[1] B.AI MiniMax M3 模型指南
[6] MiniMax 官网
代码示例
示例使用 MoleAPI 的 Responses API 地址;替换 API Key 后即可运行。
curl https://api.moleapi.com/v1/responses \
-H "Authorization: Bearer $MOLEAPI_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "MiniMax-M3",
"input": "Explain this problem step by step."
}'常见问题
MiniMax-M3 怎么计费?
本页价格从 MoleAPI 控制台接口动态读取,并随模型价格、上下文档位和账户分组更新。
MiniMax-M3 支持哪些接入方式?
本页协议和接口来自 MoleAPI 模型目录的 supported_endpoint_types 字段。
如何在现有项目中切换到 MiniMax-M3?
保留 MoleAPI 的 API 地址和密钥,把请求中的 model 参数替换为本页模型 ID;再按照对应协议检查参数差异。
MiniMax-M3 的模型资料来自哪里?
模型能力与限制已根据 B.AI 等页面核验;价格和可用协议只采用 MoleAPI 控制台数据。