MiniMax M3.1是MiniMax于2026年7月17日在世界人工智能大会(WAIC)期间首发的M3系列升级版本。M3.1在M3的基础上对原生多模态能力进行了特别明显的提升,不止适合日常创作,在工业制造、供应链协同等复杂商业场景的适配度也很高。
模型总参数428B、激活参数23B,基于MiniMax自研的MSA(MiniMax Sparse Attention)稀疏注意力架构,支持1M tokens超长上下文。M3.1能在工具流中理解图片、视频和桌面环境,在长上下文、Coding和Agentic任务上实现了进一步提升。百万级超长上下文能完整读懂整套项目文档和代码仓库。
M3.1已与OpenClaw、HermesAgent、Multica、DeerFlow等开源项目深度合作,并与华为昇腾、摩尔线程、沐曦、昆仑芯、海光、NVIDIA、AMD等芯片平台实现Day0适配。MiniMax Code在WAIC开幕前夕焕新升级,对底层架构全面重构,重点提升会话启动速度、长任务执行稳定性和工具调用的上下文衔接能力。
📋 技术规格
| 厂商 | MiniMax 稀宇科技 |
|---|---|
| 模型分类 | 多模态理解 |
| 参数规模 | 428B总参数,23B激活参数,MoE架构 |
| 上下文窗口 | 1M tokens |
| 最大输出 | 未公开 |
| 知识截止 | 2026-06 |
| API定价 | 输入: 未公开输出: 未公开 |
⭐ 核心能力详解
原生多模态提升
M3.1在M3基础上原生多模态能力显著提升,适合复杂商业场景
MSA稀疏注意力
自研MiniMax Sparse Attention,支持1M tokens超长上下文
428B/23B MoE
总参数428B激活仅23B,兼顾性能和推理效率
多芯片Day0适配
华为昇腾、NVIDIA、AMD等7+芯片平台实现Day0适配
🎯 典型应用场景
工业制造和供应链协同中的复杂文档处理
代码仓库级编程辅助和大型项目重构
多模态内容理解与生成
Agent团队协作和长程任务执行
💪 技术优势与差异化
- 原生多模态能力较M3显著提升
- 1M上下文支持完整项目文档和代码仓库
- MSA稀疏注意力架构实现高效长上下文
- 多芯片平台Day0适配,部署灵活
⚠️ 使用局限与注意事项
- 定价方案未公布
- 开源状态待确认(M3已开源,M3.1未明确)
- 具体基准测试数据未公开
- 闭源版本不支持私有化部署
💰 价格分析与成本建议
M3.1定价未公开。参考MiniMax Token Plan,Plus套餐$20/月提供最高12.5B tokens,约为Claude Pro的10倍吞吐量,性价比突出。
👥 适用人群与企业
企业开发团队、工业制造AI应用、供应链管理、多模态应用开发者
🔧 技术架构解析
| 架构设计 | 基于MiniMax自研MSA(MiniMax Sparse Attention)稀疏注意力架构,428B总参数,23B激活参数,MoE设计。 |
|---|---|
| 训练数据 | 训练数据细节未公开,Step 0联合训练实现多模态原生建模。 |
| 推理优化 | MSA稀疏注意力支持1M上下文高效推理,多芯片平台Day0适配。 |
| 部署方案 | 通过MiniMax API和Token Plan调用,MiniMax Code桌面端支持。与OpenClaw、HermesAgent等开源框架深度合作。 |
🏆 真实使用案例
📌 某制造企业用M3.1做供应链文档分析
💬 用户真实评价
M3.1的多模态能力提升明显,在工业文档处理场景表现很好。1M上下文能一次性处理整套技术文档,MSA架构让长文本推理速度很快。
🌐 行业落地洞察
M3.1在WAIC 2026首发,体现了MiniMax在多模态和工业场景的布局。MSA稀疏注意力架构和1M上下文的组合,使其在企业级长文档处理场景具有差异化竞争力。








首页 

2026-08-03




