API 平台

快速开始:单人语音生成

将一段文本合成为单一音色的语音,适合旁白、客服话术、播报和有声内容生成。

POST /v1/audio/speech

Endpoint

moss-tts

模型

  1. 创建 API Key

    进入 API Key 管理平台,创建 API Key,并保存为环境变量。不要把 API Key 写进客户端代码或提交到仓库。

    示例
    export MOSS_API_KEY="<your-api-key>"
    
  2. 准备请求输入

    model 指定模型,并补齐单人语音生成所需的输入字段。参考音色请先用 POST /v1/audio/voices 创建,得到 voice_id 后在这里使用。

    input:待合成文本 voice 或 voice_id:目标音色 response_format:输出格式,默认 mp3 delivery_method:audio 或 url

    示例
    {
      "model": "moss-tts",
      "input": "欢迎使用 Mossland API。",
      "voice_id": "<voice_id>",
      "response_format": "mp3",
      "delivery_method": "url"
    }
    
  3. 发起第一次请求

    /v1/audio/speech 发起请求。delivery_method=url 时同步返回 JSON 和结果 URL。

    curl https://api.mosi.cn/v1/audio/speech \
      -H "Authorization: Bearer $MOSS_API_KEY" \
      -H "Content-Type: application/json" \
      -d @request.json
    
  4. 获取结果

    delivery_method=url 时,直接从同步响应的 JSON 中读取结果 URL。如果传了 async=true,接口会先返回 task_id,之后用它查询任务。

    curl https://api.mosi.cn/v1/audio/tasks/$TASK_ID \
      -H "Authorization: Bearer $MOSS_API_KEY"
    
  5. 验证成功

    成功标志:拿到结果音频(delivery_method=audio)或结果 URL(delivery_method=url),可下载或播放生成音频。

下一步