Chinese AI Tools
产品模型库集成生态榜单最新变化
全球可用性使用场景提交工具账号
EN搜索

Chinese AI Tools

Independent directory for Chinese AI products. Product availability, pricing and terms can change. Verify before commercial use.

编辑标准认领产品更新资料申请推荐投放合作

MiniMax

MiniMax Audio / Speech

MiniMax Audio 覆盖 Speech 2.8、Speech 2.6 和 Speech-02 模型、40 种语言语音合成、HTTP/WebSocket 同步 TTS、异步长文本 TTS、声音克隆和官方声音管理 API。Speech 2.8 新增原生 Sound Tags,可表现呼吸、停顿、犹豫、轻笑等声音动作;支持用 10 秒样本进行更高保真克隆,并减少背景噪声和数字伪影。MiniMax 还记录了中日语对跨语言发音和口音串扰的改善。

全球可用完整英文界面公开 API免费增值

编辑结论

适合

适合评估中国语音合成、声音克隆和多语言音频生成 API 的团队。

谨慎使用

没有清晰授权、数据和商用审查前,不应在生产中使用克隆声音。

核心原因

MiniMax Audio 值得单独成档,因为官方 API 文档覆盖了聊天模型之外较完整的语音产品线。

可信度: 6/6 个来源已核验,且最近核验覆盖度: 100/100

价格

Speech 2.8 Turbo $60/M characters; HD $100/M characters; rapid cloning $1.50/voice; voice design $3/voice

Payment

Audio Subscription, Token Plan, Credits, Pay-as-you-go API billing

Commercial use

声音克隆、合成声音和生成音频使用需按当前授权和产品条款核验。

Privacy

使用真人声音前,应核验上传语音样本、克隆声音保留和生成音频存储规则。

适用场景

多语言文本转语音

强

可用 Speech 2.8 或 2.6 评估多语言 TTS、语音聊天和在线社交场景。

长文本音频生成

强

异步 TTS 适合书籍或长文档等长音频任务。

声音克隆与自定义声音

中

声音克隆和声音设计应在法律与授权核验后使用。

对话式角色语音

强

可用原生 Sound Tags 为助手、角色和旁白加入呼吸、犹豫、轻笑与节奏提示。

跨语言克隆声音

中

可在重视减少口音串扰和发音偏移的中日语音迁移场景中评估。

全球用户决策清单

注册已确认可通过 MiniMax 国际 API 平台接入。
英文界面已确认语音文档和产品页为英文入口。
API 与文档已确认官方文档覆盖 TTS、异步 TTS、声音克隆、声音设计和声音管理;Speech 2.8 发布稿记录原生 Sound Tags 和 10 秒克隆。
商用需核验声音权利、授权和生成音频使用需明确审查。

已于 2026 年 6 月 21 日核验。生产使用前请重新核验模型 ID、Sound Tag 语法、支持语言、声音克隆要求、授权控制和订阅额度。

Pros

  • - Speech 2.8 和 2.6 是当前文档列出的模型
  • - 支持 HTTP/WebSocket TTS 和异步长文本生成
  • - 提供声音克隆和声音设计 API 文档
  • - 原生 Sound Tags 可加入呼吸、停顿、犹豫和情绪化声音动作
  • - Speech 2.8 可从 10 秒参考样本克隆声音
  • - 该版本针对更少噪声和数字失真的录音棚式清晰输出进行优化

Cons

  • - 声音权利和授权要求需要明确核验
  • - 声音相似度、录音棚级清晰度和真人感说法属于厂商自报
  • - 发布稿具体展示中日语对的跨语言提升,更广泛语言收益仍需核验

替代决策路径

完整多模态接入看 API Platform

API Platform 档案覆盖计费、Key 和跨模态集成。

对比星火的中国语音工作流

星火是中国语音和垂直场景的参考。

Sources

MiniMax homepage

official · en · verified 2026-08-04

首页同时展示 Speech 2.8、M3、Hailuo 2.3 和 Music 2.6。

MiniMax Speech 2.8 news

official · en · verified 2026-06-21

确认原生 Sound Tags、10 秒高保真克隆、噪声与伪影减少、中日跨语言改善,以及通过 MiniMax Audio 和 Open Platform 提供。

MiniMax API pricing

pricing · en · verified 2026-06-21

列出 Speech 2.8 Turbo 与 HD 字符价格,以及快速声音克隆和声音设计价格。

MiniMax models overview

docs · en · verified 2026-06-01

列出 Speech 2.8、Speech 2.6 和 Speech-02 模型家族。

MiniMax speech guide

docs · en · verified 2026-06-01

记录同步 TTS 和流式调用。

MiniMax voice clone guide

docs · en · verified 2026-06-01

记录声音克隆能力。

最后核验: 2026-08-04

评论

Availability snapshot

可用性
available
英文界面
full
API
available
Rating
4.3 (0)

最新动态

最新变化
价格 · 2026-08-04

MiniMax 多模态 API 价格已更新

MiniMax 实时 API 价格显示,M3 在 512K 以内的永久五折价为输入 $0.30/百万 Token、输出 $1.20/百万、缓存读取 $0.06/百万;512K-1M 分别为 $0.60、$2.40 和 $0.12,且超过 512K 当前仍限量开放。M2.7 多模态输入与输出分别为 $0.30 和 $1.20/百万 Token,Highspeed 为 $0.60 和 $2.40。Hailuo 2.3 的 768P 六秒视频从 $0.28/条起,Speech 2.8 Turbo 为 $60/百万字符,快速声音克隆 $1.50/个声音,声音设计 $3/个声音,Music 2.6 为 $0.15/首并标注免费试用。

发布 · 2026-06-21

MiniMax Speech 2.8 档案已更新

MiniMax Speech 2.8 新增原生 Sound Tags,可表现呼吸、停顿、犹豫和带情绪的声音动作;同时支持用 10 秒样本进行更高保真声音克隆,并减少背景噪声和数字伪影。MiniMax 还重点说明中日语对的跨语言发音和口音串扰得到改善,更多语言仍在计划中。模型已通过 MiniMax Audio 和 Open Platform API 上线;克隆质量及接近真人的说法属于厂商自报,仍需在获得授权的前提下实测。

开源 · 2026-06-17

Confucius4-TTS 多语种零样本 TTS 档案已新增

网易有道 Confucius4-TTS 已收录到 AI 音频,作为 Apache-2.0 开源的多语种、跨语种零样本 TTS 引擎跟踪。档案记录其语音编码器加 LLM 架构、14 种支持语言、无需参考文本的无约束声音克隆、跨语种声音迁移、情感迁移、在线 Demo、Hugging Face 与 ModelScope 模型入口、Python 推理、微调流程和基准来源。

发布 · 2026-06-01

MiniMax M3 与最新模型波次已新增

已为 MiniMax 新增 M3 模型档案,且首页当前重点展示 M3、Hailuo 2.3、Speech 2.8 和 Music 2.6,并同时保留 API Platform、Token Plan 和 Agent 入口。

Submit a review