控制台

模型列表MOSS-VoiceGenerator

MOSS-VoiceGenerator

最新语音生成

MOSS-VoiceGenerator API 根据待合成文本和声音描述指令生成语音预览;通过自然语言描述所需的声音特征,即可生成对应风格的语音。

ENDPOINT

POST /v1/audio/voice/generations

当前调用路径

输入

文本 + 指令

请求可接受的内容

输出

音频

成功返回的内容

模型概览

根据文本和声音指令生成语音。默认使用稳定模型 ID moss-voice-generator-1.0;如需复现固定版本,可在 model 中传 moss-voice-generator-1.0-2026-07-22。

计费

本页面不写入设计占位价格;实际计费单位和单价以控制台计费标准与账单为准。

项目单价说明
模型调用见计费标准按实际请求与输出统计,以控制台账单为准。

模态支持

文本仅输入
音频仅输出
图片不支持
视频不支持

支持的 Endpoint

单人语音生成/v1/audio/speech不支持
多人对话语音生成/v1/audio/speech/speakers不支持
音频转写/v1/audio/transcriptions不支持
音色设计/v1/audio/voice/generations支持
多模态理解/v1/responses不支持

能力

性能
推理速度
流式 不支持
异步 支持
  • 指令式声音生成:通过自然语言描述声音风格
  • 支持通过 response_format 选择同步输出格式
  • 支持直接返回音频二进制或包含结果 URL 的 JSON
  • 支持异步任务,结果通过任务查询获取

版本与快照

Model IDmoss-voice-generator-1.0
快照moss-voice-generator-1.0-2026-07-22最新版本