MiniMax
MiniMax 的前沿编程与智能体模型,具备 100 万上下文和原生多模态理解能力。
快速结论
M3 应单独跟踪,因为官方首页现在给了它独立模型页,并将其定位为当前前沿编程模型。
MiniMax M3 于 2026 年 6 月 1 日发布,是 MiniMax 面向编程、Agent 和原生图像/视频理解的旗舰模型。其 MiniMax Sparse Attention 架构支持 API 最高 100 万 Token 上下文,并保证至少 512K。MiniMax 披露,在 100 万上下文下,每 Token 计算量为上一代的 1/20,Prefill 提速超过 9 倍,Decode 提速超过 15 倍。API 使用 MiniMax-M3 模型标识,支持思考与非思考模式,输入超过 512K Token 时采用更高的长上下文费率,并为 SLA 敏感负载提供可选 Priority 服务等级。官方 427B 参数权重现已在 Hugging Face 按 MiniMax Community License 发布,尽管本次核验的产品页仍保留较早的“即将发布”文案。
专题指南基于来源梳理 MiniMax M3、API 与 Token Plan 接入、Mavis Agent、MiniMax Design、Hailuo、语音、音乐和图像产品。
编辑结论
适合评估中国来源前沿模型在编程、长上下文智能体工作和多模态推理上的开发者。
如果你需要已完全锁定的公开价格和稳定商用条款,就不应优先考虑它。
M3 应单独跟踪,因为官方首页现在给了它独立模型页,并将其定位为当前前沿编程模型。
API & Token Plan access; current pricing should be checked in account
API & Token Plan, Pay-as-you-go API billing, Enterprise sales
商用应遵守当前产品、API、模型许可证和计费条款。
处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。
评估仓库修复、终端执行、Kernel 优化和 MCP 工具使用,并独立复现厂商基准设置。
100 万上下文窗口使其适合大代码库、长文档和多步骤智能体任务。
使用原生图像和视频输入处理文档理解、视觉编程任务和 Computer Use Agent。
发布文章披露了 12 小时论文复现和 24 小时 CUDA 优化任务;应在自有任务上验证成本、可靠性和恢复能力。
已于 2026 年 9 月 7 日复核官方产品页和权重页。官方 Hugging Face 仓库已按 MiniMax Community License 提供权重,但产品页仍保留较早的“即将发布”文案。推广前仍需核验当前 API 价格、额度和 Priority 等级可用性。
minimax-api
qwen
deepseek
zhipu-glm
kimi
官方 · EN · 核验于 2026-09-07
确认编程与 Agent 定位、API 保证 512K 和最高 1M 上下文、原生多模态、BrowseComp 成绩和长程案例;其中权重发布文案早于现已上线的官方仓库。
代码仓库 · EN · 核验于 2026-09-07
确认 427B 参数权重已按 MiniMax Community License 上线,约激活 23B 参数,支持 100 万上下文及文本、图像和视频输入。
最后核验: 2026-09-07
暂无已审核的评论。