复制 Markdown模型概览Moss API 平台模型按能力分为语音生成、语音识别与多模态理解。点击任一模型卡片可展开右侧详情。语音生成MOSS-TTS-1.5-Flash单人文本转语音模型MOSS-TTS-1.0-Pro单人文本转语音模型MOSS-TTSD-1.0多人对话语音合成模型MOSS-Voice-Generator-1.0根据文本和声音指令生成语音语音识别MOSS-Transcribe-1.0普通音频转写模型MOSS-Transcribe-Diarize-Pro多说话人转写模型多模态理解MOSS-VL-1.0图像与视频理解模型