# MiniMax: MiniMax-M3

- 模型 ID: `MiniMax-M3`
- 供应商: MiniMax
- 网页版本: https://www.moleapi.com/zh-CN/models/minimax/minimax-m3
- 内容状态: alias

## 模型简介

MiniMax M3 是 MiniMax 面向百万级上下文、代理与办公自动化的新一代模型，采用稀疏注意力降低长上下文计算成本。

## 模型能力

- OpenAI 兼容
- Responses API
- Anthropic 兼容
- Gemini 兼容
- 提示词缓存
- 推理

### 已核验规格

- 官方定位: 长上下文代理与办公模型
- 上下文窗口: 1,000,000 tokens
- 核心架构: MiniMax Sparse Attention
- 重点场景: 代理、文档、表格、演示文稿

## 模型价格和接入方式

价格由 MoleAPI 控制台接口动态提供。

### 标准 (default, x1)

- 输入: $0.3 / 1M tokens
- 输出: $1.2 / 1M tokens
- 缓存读取: $0.06 / 1M tokens

### 特价 (discount, x0.8)

- 输入: $0.24 / 1M tokens
- 输出: $0.96 / 1M tokens
- 缓存读取: $0.048 / 1M tokens

### 转接 (relay, x0.3)

- 输入: $0.09 / 1M tokens
- 输出: $0.36 / 1M tokens
- 缓存读取: $0.018 / 1M tokens

### 接入协议

| Protocol | Method | Endpoint |
| --- | --- | --- |
| openai | POST | /v1/chat/completions |
| openai-response | POST | /v1/responses |
| anthropic | POST | /v1/messages |
| gemini | POST | /v1beta/models/{model}:generateContent |

- 实时价格来源: https://home.moleapi.com/api/pricing

## MiniMax-M3 模型介绍

MiniMax M3 是 MiniMax 面向编程与智能体任务的前沿语言模型，采用 MiniMax Sparse Attention（MSA）架构，并提供 100 万 token 上下文窗口。 [6]

## 模型定位与核心能力

MiniMax 将 M3 定位为面向编程和智能体工作流的模型，重点覆盖超长上下文处理。 [6]  
MSA 是其核心注意力架构，旨在降低百万 token 上下文下的注意力计算成本。 [1]

MSA 使用两阶段、基于 GQA 的稀疏注意力机制：索引分支选择相关 KV 块，稀疏分支仅对选中的块执行注意力计算。 [1] 该设计面向长上下文推理效率，并服务于大型代码库理解、多文档处理和长任务上下文。 [1]

## 能力与规格

M3 的官方上下文窗口为 100 万 token，属于 MiniMax 面向长上下文任务的语言模型。 [6]

| 规格 | 信息 |
|---|---|
| 模型定位 | 编程与智能体模型 [6] |
| 上下文窗口 | 1,000,000 token [6] |
| 核心架构 | MiniMax Sparse Attention（MSA） [6] |
| 长上下文机制 | 基于 GQA 的两阶段稀疏注意力 [1] |

B.AI 的模型文档将 M3 描述为支持文本工作流、函数调用和智能体工作流的平台模型。 [1] 图像输入是否可用取决于具体平台的发布进度和模型配置。 [1]

## 使用场景

M3 面向需要处理大规模上下文的编程、分析和智能体任务。 [6]  
其适用工作负载包括多文档分析、长对话历史处理和大型代码库理解。 [1]

结合工具使用、推理和长上下文状态的智能体工作流是该模型的目标场景之一。 [1] 办公自动化场景包括文档、电子表格和演示文稿的处理或生成。 [1]

## 重要限制

M3 的部分能力由部署平台和模型配置决定，图像输入并非所有平台配置下均可用。 [1]  
最终可用性、模型限额和基准信息可能随发布进度更新。 [1]

## 来源

[1] [B.AI MiniMax M3 模型指南](https://docs.b.ai/llmservice/models/minimax-m3/)  
[6] [MiniMax 官网](https://www.minimax.io/)


## 代码示例

### cURL

```bash
curl https://api.moleapi.com/v1/responses \
  -H "Authorization: Bearer $MOLEAPI_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"MiniMax-M3","input":"Explain this problem step by step."}'
```

### Python

```python
from openai import OpenAI

client = OpenAI(base_url="https://api.moleapi.com/v1", api_key="YOUR_MOLEAPI_API_KEY")
response = client.responses.create(model="MiniMax-M3", input="Explain this problem step by step.")
print(response.output_text)
```

### TypeScript

```typescript
import OpenAI from "openai";

const client = new OpenAI({ baseURL: "https://api.moleapi.com/v1", apiKey: process.env.MOLEAPI_API_KEY });
const response = await client.responses.create({ model: "MiniMax-M3", input: "Explain this problem step by step." });
console.log(response.output_text);
```

## 更多相关模型

- [minimax-m3](https://www.moleapi.com/zh-CN/models/minimax/minimax-m3) — MiniMax
- [minimaxai/minimax-m3](https://www.moleapi.com/zh-CN/models/minimax/minimaxai-minimax-m3) — MiniMax
- [minimax-m2.7](https://www.moleapi.com/zh-CN/models/minimax/minimax-m2.7) — MiniMax
- [gpt-5.6-luna](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-luna) — OpenAI
- [gpt-5.6-sol](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-sol) — OpenAI
- [gpt-5.6-terra](https://www.moleapi.com/zh-CN/models/openai/gpt-5.6-terra) — OpenAI

## 常见问题

### MiniMax-M3 怎么计费？

本页价格从 MoleAPI 控制台接口动态读取，并随模型价格、上下文档位和账户分组更新。

### MiniMax-M3 支持哪些接入方式？

当前目录列出的协议是 openai、openai-response、anthropic、gemini。

### 如何在现有项目中切换到 MiniMax-M3？

保留 MoleAPI 的 API 地址和密钥，替换 model 参数，再检查所用协议的参数差异。

### MiniMax-M3 的资料来自哪里？

模型能力与限制根据 B.AI 等列明页面核验；价格与协议来自 MoleAPI 控制台。
