单人语音生成
将一段文本合成为单一音色的语音,适合旁白、客服话术、播报和有声内容生成。
操作流程
POST /v1/audio/speech
Endpoint
moss-tts
模型
创建 API Key
进入 API Key 管理平台,创建 API Key,并保存为环境变量。不要把 API Key 写进客户端代码或提交到仓库。
示例 export MOSS_API_KEY="<your-api-key>"准备请求输入
用
model指定模型,并补齐单人语音合成需要的输入字段。参考音色请先用POST /v1/audio/voices创建,得到voice_id后在这里使用。input:待合成文本 voice 或 voice_id:目标音色 response_format:输出格式,默认 mp3 delivery_method:audio 或 url
request.json { "model": "moss-tts", "input": "欢迎使用 MOSI 语音合成服务,这是一段示例旁白。", "voice_id": "<voice_id>", "response_format": "mp3", "delivery_method": "url" }发起第一次请求
向
POST /v1/audio/speech发起请求。delivery_method=url时同步返回 JSON 和结果 URL。curl https://api.mosi.cn/v1/audio/speech \ -H "Authorization: Bearer $MOSS_API_KEY" \ -H "Content-Type: application/json" \ -d @request.json获取结果
delivery_method=url时,从同步响应的 JSON 中读取结果 URL。如果传了async=true,接口会先返回task_id,再用它查询任务。curl https://api.mosi.cn/v1/audio/tasks/$TASK_ID \ -H "Authorization: Bearer $MOSS_API_KEY"验证成功
成功标志:拿到结果音频(
delivery_method=audio)或结果 URL(delivery_method=url),可下载或播放生成音频。