AI 大模型
MiniMax
abab / 海螺系列大模型,长文本、多模态、语音合成、视频生成
访问 MiniMaxMiniMax 是国内较早投入通用大模型研发的公司之一,开放平台提供文本、语音、视频等多模态能力的 API。其中语音合成方向的能力在国内平台中辨识度较高,支持较丰富的音色与情感表达。
核心能力
- 文本对话模型,支持长上下文
- 语音合成(TTS),提供多音色与情感、语速等参数控制
- 语音识别与语音克隆方向的能力
- 图像与视频生成
- 向量嵌入与函数调用
典型场景
在互动娱乐、虚拟角色、有声内容制作、教育产品中应用较多。需要把文本内容批量转成自然语音的场景(有声书、播客、课程配音、智能硬件语音播报)是它较有优势的方向;文本模型则常被用于对话式产品与内容生成。
接入方式
注册后在控制台创建 API Key 调用,文本接口提供 OpenAI 兼容形态。语音与视频生成属于独立接口,其中视频生成等耗时任务通常采用异步模式:提交任务后轮询或通过回调获取结果,接入时需要在业务侧设计好任务状态管理。
注意事项
个人开发者可直接注册。语音克隆类能力涉及声音权利与合规风险,用于生产前务必确认素材授权情况以及平台的使用条款。多模态能力的计费单位各不相同(按 token、按字符、按时长或按次),做成本模型时需要分别核算。
编目记录 · record
- 收录日期
- 2026.08.14
- 链接核对
- 2026.08.14 境内节点实测可达
- 刻意不收录
- 价格 免费额度 限流阈值
这类数值变动频繁,静态页面无法保证准确,写进来就会变成过期错误信息。 需要准确数值请以官方文档为准;本站的取舍依据见编辑原则。