MOSS-VoiceGenerator
最新语音生成MOSS-VoiceGenerator API 根据待合成文本和声音描述指令生成语音预览;通过自然语言描述所需的声音特征,即可生成对应风格的语音。
ENDPOINT
POST /v1/audio/voice/generations
当前调用路径
输入
文本 + 指令
请求可接受的内容
输出
音频
成功返回的内容
模型概览
根据文本和声音指令生成语音。默认使用稳定模型 ID moss-voice-generator-1.0;如需复现固定版本,可在 model 中传 moss-voice-generator-1.0-2026-07-22。
计费
本页面不写入设计占位价格;实际计费单位和单价以控制台计费标准与账单为准。
项目单价说明
模型调用
见计费标准按实际请求与输出统计,以控制台账单为准。模态支持
文文本仅输入
音音频仅输出
图图片不支持
视视频不支持
支持的 Endpoint
单人语音生成
/v1/audio/speech不支持多人对话语音生成
/v1/audio/speech/speakers不支持音频转写
/v1/audio/transcriptions不支持音色设计
/v1/audio/voice/generations支持多模态理解
/v1/responses不支持能力
性能—
推理速度—
流式 不支持
异步 支持
- 指令式声音生成:通过自然语言描述声音风格
- 支持通过 response_format 选择同步输出格式
- 支持直接返回音频二进制或包含结果 URL 的 JSON
- 支持异步任务,结果通过任务查询获取
版本与快照
Model ID
moss-voice-generator-1.0快照
moss-voice-generator-1.0-2026-07-22最新版本