Matrix TTS 上手:零样本声音克隆与多语种合成
· 阅读需 2 分钟
matrix-tts-v1 是什么
- 零样本:提供一段参考音频即可克隆音色,无需额外训练
- 多语种:支持中文、英文、日语、西班牙语、法语、阿拉伯语等语种
- 音色控制:可调整语速,并按性别、年龄、音调等属性设计音色
- OpenAI 兼容:通过
/v1/audio/speech接口调用
/v1/audio/speech 接口调用看到一个有趣的开源 AI 项目后,真正体验它通常要经历:克隆仓库、阅读 README、安装 Python 或 Node 环境、配置 CUDA 或 Docker、准备 API Key,最后才能把服务跑起来。
但多数时候,用户只想直接试试它是否适合自己。
让任意 OpenAI 兼容的客户端只需要配置一次 Base URL 和 Key,就能跨厂商调用模型。适用的客户端包括 Cursor、Cherry Studio、自建应用和各类 OpenAI SDK。
可用模型会持续更新,请以 Matrix 模型列表 为准。
如果让所有用户共用同一个开源应用实例,会遇到:
所以 Matrix 选择 每个用户、每个应用一份实例,并通过容器调度优化控制成本。