MiniMax M3 模型档案
- 厂商:MiniMax
- 版本:MiniMax M3
- 调用方式:MiniMax API(模型 ID:
MiniMax-M3)、MiniMax Code、Token Plan - 上下文窗口:最大 1,000,000 tokens(官方标称;实际可用上限以 API 配置为准)
- 计费方式:按 MiniMax 开放平台当前价格页核对;本文不臆测具体单价
核对日期:2026-07-20。能力与上下文信息来自 MiniMax 官方模型页和发布说明;价格、限流和版本快照仍应以控制台为准。
综合评分
综合得分:87.5/100|数据覆盖率:100%|证据强度:B|核对日期:2026-07-20
| 维度 | 权重 | 得分 | 说明 |
|---|---|---|---|
| 推理 | 20% | 8.8 | 面向复杂任务与 Agent 工作流,官方展示 BrowseComp 83.5 |
| 编程 | 15% | 9.0 | 强调前沿编程与长程 Agent 编码 |
| 语言与知识 | 15% | 8.4 | 通用文本生成与知识问答能力完整 |
| 多模态 | 10% | 9.1 | 原生支持图像、视频输入及桌面操作 |
| 上下文 | 10% | 9.6 | 最大 1M 上下文,采用 MSA 稀疏注意力 |
| 速度 | 10% | 8.3 | 稀疏注意力有利于长上下文效率,端到端延迟需实测 |
| 成本效益 | 10% | 8.5 | 开放模型并提供 API、Code、Token Plan,多档计费待核价 |
| 工具生态 | 5% | 8.6 | 支持工具调用、Agent 和计算机操作 |
| 安全稳定 | 5% | 8.0 | 生产稳定性、配额与安全策略需结合部署环境验证 |
模型概览
MiniMax M3 是 MiniMax 于 2026-06-01 发布的开放模型,定位为前沿编程和 Agent 任务模型。官方模型页给出 API 模型 ID MiniMax-M3、最大 1M 上下文,并展示 BrowseComp 83.5 的官方测试结果。
核心能力
- 长上下文:最大 1,000,000 tokens,适合大型代码库、长文档和多轮 Agent 轨迹。
- 编程与 Agent:面向复杂编程、工具调用和长程任务执行。
- 原生多模态:支持图像与视频输入,可进行视频内容理解。
- 计算机操作:支持桌面操作类 Agent 场景。
- 推理效率:采用 MiniMax Sparse Attention(MSA),降低超长上下文计算开销。
- 缓存能力:API 支持自动缓存,适合重复前缀的工作流。
价格与配额
本文未记录具体输入/输出单价、缓存折扣、并发和速率限制。接入前请在 MiniMax 开放平台价格页核对区域、套餐、缓存和超长上下文附加费用。
优势与限制
优势
- 1M 上下文与稀疏注意力适合大规模代码和资料分析。
- 编程、工具调用、视觉输入和桌面操作覆盖面广。
- 同时提供 API、Code 和 Token Plan,便于个人到企业逐步接入。
限制
- 官方公开资料对价格、限流、版本快照和安全合规细节披露有限。
- BrowseComp 等成绩为官方声明,跨模型比较前应统一评测条件。
- 超长上下文的实际延迟和有效召回率需按业务数据实测。
推荐使用场景
- 大型代码库理解、重构和自动化修复。
- 多步骤工具调用、浏览和计算机操作 Agent。
- 长文档/视频资料的检索、总结与问答。
不推荐使用场景
- 对固定低延迟和极低单价有硬性要求、且不需要长上下文的简单分类任务。
- 尚未完成数据合规、配额和故障切换验证的核心生产链路。
结论
MiniMax M3 适合作为长上下文编程与多模态 Agent 的候选主力模型。建议先以 API 灰度接入,使用真实代码库和工具链验证延迟、成本、稳定性及安全策略,再决定是否扩大生产流量。
官方资料
更新记录
| 日期 | 更新内容 | 编辑者 |
|---|---|---|
| 2026-07-20 | 新增 MiniMax M3 模型档案与评分 | Codex |