MiniMax
MiniMax M3 于 2026 年 6 月 1 日发布,是 MiniMax 面向编程、Agent 和原生图像/视频理解的旗舰模型。其 MiniMax Sparse Attention 架构支持 API 最高 100 万 Token 上下文,并保证至少 512K。MiniMax 披露,在 100 万上下文下,每 Token 计算量为上一代的 1/20,Prefill 提速超过 9 倍,Decode 提速超过 15 倍。API 使用 MiniMax-M3 模型标识,可在同价下切换思考与非思考模式,输入超过 512K Token 时采用更高的长上下文费率,并为 SLA 敏感负载提供可选 Priority 服务等级。MiniMax 将 M3 称为 open-weight,但本次核验的模型页同时写明完整 Hugging Face 和 GitHub 发布即将到来,因此当前权重可用性仍需单独确认。
编辑结论
适合评估中国来源前沿模型在编程、长上下文智能体工作和多模态推理上的开发者。
如果你需要已完全锁定的公开价格和稳定商用条款,就不应优先考虑它。
M3 应单独跟踪,因为官方首页现在给了它独立模型页,并将其定位为当前前沿编程模型。
API & Token Plan access; current pricing should be checked in account
API & Token Plan, Pay-as-you-go API billing, Enterprise sales
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
评估仓库修复、终端执行、Kernel 优化和 MCP 工具使用,并独立复现厂商基准设置。
100 万上下文窗口使其适合大代码库、长文档和多步骤智能体任务。
使用原生图像和视频输入处理文档理解、视觉编程任务和 Computer Use Agent。
发布文章披露了 12 小时论文复现和 24 小时 CUDA 优化任务;应在自有任务上验证成本、可靠性和恢复能力。
已于 2026 年 6 月 21 日复核官方模型页。发布文章属于带日期的产品快照,实时 Token Plan 可能调整额度,且模型页仍将完整 Hugging Face 和 GitHub 发布描述为即将到来。推广前请重新核验当前价格、额度、权重和 Priority 等级可用性。
minimax-api
qwen
deepseek
zhipu-glm
kimi
official · en · verified 2026-08-04
确认编程与 Agent 定位、API 保证 512K 和最高 1M 上下文、原生多模态、BrowseComp 成绩、长程案例、API 标识及完整开源发布仍待完成。
official · en · verified 2026-06-10
记录 6 月 1 日发布、MSA 效率、基准方法、真实 Agent 任务、API 模式和接入路径。
最后核验: 2026-08-04