API 平台

单人语音生成

把文本合成为语音。该接口对齐 POST /v1/audio/speechvoice_id 只接受 voice id,不接受音色 url、multipart 音色文件或 base64。

POST
/v1/audio/speech

文本转语音。请求体为 JSON;delivery_method=url 返回 JSON(含结果 URL),delivery_method=audio(默认)返回音频二进制。

认证

在请求头中加入 Authorization: Bearer <API_KEY> 完成鉴权,密钥可在控制台「API 密钥」页生成。

示例
curl https://api.mosi.cn/v1/audio/speech \
  -H "Authorization: Bearer $MOSS_API_KEY"

支持模型

字段允许值
model

moss-tts

请求字段

字段类型必填说明
modelstring

模型名称,取值见「支持模型」,例如 moss-tts

versionstring

指定已上线且对外开放的模型版本;不传使用服务端当前默认版本。

inputstring

待合成文本。

voice_idstring

音色 ID;可通过 查询音色列表 获取;也可前往 Mossland 音色库,在音色卡片上点击复制图标获取。TTS 只接受音色 ID,不支持 voice_url / voice_data,也不接受内联音频或参考音频。

response_formatstring

同步请求的音频格式,例如 mp3 / wav;异步任务实际格式以任务查询返回为准。

delivery_methodstring

audio(默认)直接返回音频二进制;url 返回 JSON 和结果 URL。

asyncboolean

设为 true 时创建异步任务并立即返回任务对象,结果经任务查询或 webhook_url 获取。

webhook_urlstring

异步任务完成后回调的 HTTPS URL。

请求示例

curl https://api.mosi.cn/v1/audio/speech \
  -H "Authorization: Bearer $MOSS_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "moss-tts",
    "input": "hello",
    "voice_id": "<voice_id>",
    "response_format": "mp3",
    "delivery_method": "url"
  }'

响应字段

delivery_method=url 时返回 JSON(含结果 URL):

字段类型必返说明
idstring

任务/结果 ID。同步 URL JSON 响应统一使用 id

objectstring

固定为 audio.speech

statusstring

任务状态,例如 SUCCESS

urlstring

音频结果 URL。

response_formatstring

实际输出音频格式,例如 mp3

content_typestring

音频 MIME 类型,例如 audio/mpeg

created_atinteger

创建时间,Unix 时间戳,单位为秒。

异步创建响应字段

async=true 时立即返回:

字段类型必返说明
idstring

任务 ID。

task_idstring

任务查询 ID,通常与 id 相同。

objectstring

固定为 audio.speech

statusstring

初始状态,例如 PENDING

retry_afterinteger

建议轮询间隔,单位为秒。

created_atinteger

创建时间,Unix 时间戳,单位为秒。

updated_atinteger

更新时间,Unix 时间戳,单位为秒。

响应示例

响应示例
{
  "id": "task_abc123",
  "object": "audio.speech",
  "status": "SUCCESS",
  "url": "https://cdn.example.com/out.mp3",
  "response_format": "mp3",
  "content_type": "audio/mpeg",
  "created_at": 1710000000
}

下一步