Chinese AI Tools
产品模型库集成生态榜单最新变化
全球可用性使用场景提交工具账号
EN搜索

Chinese AI Tools

Independent directory for Chinese AI products. Product availability, pricing and terms can change. Verify before commercial use.

编辑标准认领产品更新资料申请推荐投放合作

MiniMax

MiniMax M3

MiniMax M3 于 2026 年 6 月 1 日发布,是 MiniMax 面向编程、Agent 和原生图像/视频理解的旗舰模型。其 MiniMax Sparse Attention 架构支持 API 最高 100 万 Token 上下文,并保证至少 512K。MiniMax 披露,在 100 万上下文下,每 Token 计算量为上一代的 1/20,Prefill 提速超过 9 倍,Decode 提速超过 15 倍。API 使用 MiniMax-M3 模型标识,可在同价下切换思考与非思考模式,输入超过 512K Token 时采用更高的长上下文费率,并为 SLA 敏感负载提供可选 Priority 服务等级。MiniMax 将 M3 称为 open-weight,但本次核验的模型页同时写明完整 Hugging Face 和 GitHub 发布即将到来,因此当前权重可用性仍需单独确认。

全球可用完整英文界面公开 API免费增值

编辑结论

适合

适合评估中国来源前沿模型在编程、长上下文智能体工作和多模态推理上的开发者。

谨慎使用

如果你需要已完全锁定的公开价格和稳定商用条款,就不应优先考虑它。

核心原因

M3 应单独跟踪,因为官方首页现在给了它独立模型页,并将其定位为当前前沿编程模型。

可信度: 3/3 个来源已核验,且最近核验覆盖度: 100/100

价格

API & Token Plan access; current pricing should be checked in account

Payment

API & Token Plan, Pay-as-you-go API billing, Enterprise sales

Commercial use

商用应遵守当前产品、API、模型许可证和计费条款。

Privacy

处理敏感负载前,请核验提示词、文件、媒体上传、保留和训练使用条款。

适用场景

前沿编程评估

强

评估仓库修复、终端执行、Kernel 优化和 MCP 工具使用,并独立复现厂商基准设置。

长上下文智能体工作流

强

100 万上下文窗口使其适合大代码库、长文档和多步骤智能体任务。

多模态推理

强

使用原生图像和视频输入处理文档理解、视觉编程任务和 Computer Use Agent。

长程自主任务

中

发布文章披露了 12 小时论文复现和 24 小时 CUDA 优化任务;应在自有任务上验证成本、可靠性和恢复能力。

全球用户决策清单

注册部分首页暴露 API 和 Token Plan 路径,但具体账号流程仍需按目标地区复核。
英文界面已确认首页、模型页和报告页均面向英文用户。
API 与文档已确认文档公开 MiniMax-M3 标识和 chatcompletion_v2 端点、最高 1M 且保证至少 512K 上下文、思考模式选择、512K 价格分界,以及 Standard 与 Priority 服务等级。
国际支付部分API 和 Token Plan 接入公开,但实时价格与额度应以当前页面为准,而不是发布文章快照。
商用部分生产用户需核验模型权重许可证、API 条款、Priority 等级接入和多模态数据处理规则。

已于 2026 年 6 月 21 日复核官方模型页。发布文章属于带日期的产品快照,实时 Token Plan 可能调整额度,且模型页仍将完整 Hugging Face 和 GitHub 发布描述为即将到来。推广前请重新核验当前价格、额度、权重和 Priority 等级可用性。

Pros

  • - 厂商披露的成绩包括 SWE-Bench Pro 59.0%、Terminal-Bench 2.1 66.0% 和 MCP Atlas 74.2%
  • - API 上下文明确为最高 100 万 Token,并保证至少 512K
  • - 原生图像和视频理解覆盖 Computer Use 场景
  • - API 请求可按需选择思考或非思考模式
  • - 厂商披露 BrowseComp 83.5 分,以及持续 12 至 24 小时的长程自主任务

Cons

  • - 多数对比成绩和真实任务演示由厂商执行,仍需独立复现
  • - 输入超过 512K Token 时采用更高的长上下文 API 费率
  • - 按发布文章信息,Priority 服务等级需要通过销售开通
  • - 模型页虽将 M3 称为 open-weight,但也写明完整 Hugging Face 和 GitHub 开源发布仍即将到来

替代决策路径

minimax-api

qwen

deepseek

zhipu-glm

kimi

Sources

MiniMax M3 model page

official · en · verified 2026-08-04

确认编程与 Agent 定位、API 保证 512K 和最高 1M 上下文、原生多模态、BrowseComp 成绩、长程案例、API 标识及完整开源发布仍待完成。

MiniMax M3 report

official · en · verified 2026-06-10

记录 6 月 1 日发布、MSA 效率、基准方法、真实 Agent 任务、API 模式和接入路径。

MiniMax homepage

official · en · verified 2026-06-01

在公开首页展示 M3、Hailuo 2.3、Speech 2.8 和 Music 2.6。

最后核验: 2026-08-04

评论

Availability snapshot

可用性
available
英文界面
full
API
available
Rating
4.6 (0)

最新动态

最新变化
价格 · 2026-08-04

MiniMax 多模态 API 价格已更新

MiniMax 实时 API 价格显示,M3 在 512K 以内的永久五折价为输入 $0.30/百万 Token、输出 $1.20/百万、缓存读取 $0.06/百万;512K-1M 分别为 $0.60、$2.40 和 $0.12,且超过 512K 当前仍限量开放。M2.7 多模态输入与输出分别为 $0.30 和 $1.20/百万 Token,Highspeed 为 $0.60 和 $2.40。Hailuo 2.3 的 768P 六秒视频从 $0.28/条起,Speech 2.8 Turbo 为 $60/百万字符,快速声音克隆 $1.50/个声音,声音设计 $3/个声音,Music 2.6 为 $0.15/首并标注免费试用。

发布 · 2026-06-30

OpenRouter Owl Alpha 已收录

OpenRouter 的 Owl Alpha 现已作为面向智能体编程、工具调用、自动化工作流和复杂指令执行的免费文本模型收录。实时模型 API 列出 1,048,756 tokens 上下文、最大 262,144 tokens 输出、原生工具和结构化输出、输入输出 token 均为零价格,以及单一 Stealth INT8 提供方路由。OpenRouter 表示它兼容 Claude Code 和 OpenClaw,但也警告提供方可能记录提示词和输出并用于模型改进。由于底层模型身份和许可证仍未披露,档案将其视为非敏感 Alpha 评估路由,而不是默认可安全投入生产的模型。

开源 · 2026-06-26

DeepReinforce Ornith 1.0 开源编程模型已收录

DeepReinforce 的 Hugging Face 组织页现已公开 Ornith 1.0 系列 MIT 许可智能体编程模型。合集包含 9B、35B、397B 公开模型卡,以及 GGUF 和 FP8 版本。模型卡将 Ornith 定位为基于 Gemma 4 和 Qwen 3.5 后训练的自改进模型族,通过强化学习同时优化解题 rollout 及其 scaffold,并披露 Terminal-Bench 2.1、SWE-Bench、NL2Repo、SWE Atlas 和 ClawEval 结果。档案已记录 vLLM、SGLang、Transformers 和 OpenAI 兼容本地服务路径。

价格 · 2026-06-21

MiniMax Token Plan 价格已更新

MiniMax Token Plan 的 Plus、Max、Ultra 月价分别为 20、50 和 120 美元,年付免两个月后分别为 200、500 和 1,200 美元。三档套餐估算每月含 17 亿、51 亿和 125 亿 M3 Token,并支持约 3-4、4-5 和 6-7 个并发 Agent。额度在支持的模态间共享,受 5 小时滚动窗口和周窗口约束且不结转;MiniMax 建议生产负载使用按量计费。

Submit a review