MiniMax M3 模型档案

MiniMax M3 模型档案

  • 厂商:MiniMax
  • 版本:MiniMax M3
  • 调用方式:MiniMax API(模型 ID:MiniMax-M3)、MiniMax Code、Token Plan
  • 上下文窗口:最大 1,000,000 tokens(官方标称;实际可用上限以 API 配置为准)
  • 计费方式:按 MiniMax 开放平台当前价格页核对;本文不臆测具体单价

核对日期:2026-07-20。能力与上下文信息来自 MiniMax 官方模型页和发布说明;价格、限流和版本快照仍应以控制台为准。

综合评分

综合得分:87.5/100|数据覆盖率:100%|证据强度:B|核对日期:2026-07-20

维度 权重 得分 说明
推理 20% 8.8 面向复杂任务与 Agent 工作流,官方展示 BrowseComp 83.5
编程 15% 9.0 强调前沿编程与长程 Agent 编码
语言与知识 15% 8.4 通用文本生成与知识问答能力完整
多模态 10% 9.1 原生支持图像、视频输入及桌面操作
上下文 10% 9.6 最大 1M 上下文,采用 MSA 稀疏注意力
速度 10% 8.3 稀疏注意力有利于长上下文效率,端到端延迟需实测
成本效益 10% 8.5 开放模型并提供 API、Code、Token Plan,多档计费待核价
工具生态 5% 8.6 支持工具调用、Agent 和计算机操作
安全稳定 5% 8.0 生产稳定性、配额与安全策略需结合部署环境验证

模型概览

MiniMax M3 是 MiniMax 于 2026-06-01 发布的开放模型,定位为前沿编程和 Agent 任务模型。官方模型页给出 API 模型 ID MiniMax-M3、最大 1M 上下文,并展示 BrowseComp 83.5 的官方测试结果。

核心能力

  • 长上下文:最大 1,000,000 tokens,适合大型代码库、长文档和多轮 Agent 轨迹。
  • 编程与 Agent:面向复杂编程、工具调用和长程任务执行。
  • 原生多模态:支持图像与视频输入,可进行视频内容理解。
  • 计算机操作:支持桌面操作类 Agent 场景。
  • 推理效率:采用 MiniMax Sparse Attention(MSA),降低超长上下文计算开销。
  • 缓存能力:API 支持自动缓存,适合重复前缀的工作流。

价格与配额

本文未记录具体输入/输出单价、缓存折扣、并发和速率限制。接入前请在 MiniMax 开放平台价格页核对区域、套餐、缓存和超长上下文附加费用。

优势与限制

优势

  1. 1M 上下文与稀疏注意力适合大规模代码和资料分析。
  2. 编程、工具调用、视觉输入和桌面操作覆盖面广。
  3. 同时提供 API、Code 和 Token Plan,便于个人到企业逐步接入。

限制

  1. 官方公开资料对价格、限流、版本快照和安全合规细节披露有限。
  2. BrowseComp 等成绩为官方声明,跨模型比较前应统一评测条件。
  3. 超长上下文的实际延迟和有效召回率需按业务数据实测。

推荐使用场景

  • 大型代码库理解、重构和自动化修复。
  • 多步骤工具调用、浏览和计算机操作 Agent。
  • 长文档/视频资料的检索、总结与问答。

不推荐使用场景

  • 对固定低延迟和极低单价有硬性要求、且不需要长上下文的简单分类任务。
  • 尚未完成数据合规、配额和故障切换验证的核心生产链路。

结论

MiniMax M3 适合作为长上下文编程与多模态 Agent 的候选主力模型。建议先以 API 灰度接入,使用真实代码库和工具链验证延迟、成本、稳定性及安全策略,再决定是否扩大生产流量。

官方资料

更新记录

日期 更新内容 编辑者
2026-07-20 新增 MiniMax M3 模型档案与评分 Codex