模型列表
当前模型覆盖语音生成、语音识别与多模态理解。model 决定调用能力;如需固定版本,可将 snapshot model ID 作为 model 传入。
模型名称说明计费标准流式输出异步
moss-tts-1.5-flash推荐snapshot: moss-tts-1.5-flash-2026-06-26单人文本转语音模型 · 文本 + voice_id → 音频POST /v1/audio/speech¥2.00 / 万字符40 积分 / 万字符✓✓moss-tts-1.0-pro历史snapshot: moss-tts-1.0-pro-2026-02-07单人文本转语音模型 · 文本 + voice_id → 音频POST /v1/audio/speech¥2.00 / 万字符40 积分 / 万字符—✓moss-ttsd-1.0最新snapshot: moss-ttsd-1.0-2026-03-20多人对话语音合成模型 · 文本 → 音频POST /v1/audio/speech/speakers¥2.00 / 万字符40 积分 / 万字符—✓moss-voice-generator-1.0最新snapshot: moss-voice-generator-1.0-2026-07-22根据文本和声音指令生成语音 · 文本 + 指令 → 音频POST /v1/audio/voice/generations¥2.00 / 万字符40 积分 / 万字符—✓moss-transcribe-1.0最新snapshot: moss-transcribe-1.0-2026-07-22普通音频转写模型 · 音频 → 文本POST /v1/audio/transcriptions¥0.80 / 小时16 积分 / 小时—✓moss-transcribe-diarize-pro推荐snapshot: moss-transcribe-diarize-pro-2026-07-03多说话人转写模型,最长支持 60 分钟音频 · 音频 → 文本POST /v1/audio/transcriptions¥2.00 / 小时40 积分 / 小时✓✓moss-vl-1.0Betasnapshot: moss-vl-1.0-2026-07-08多模态理解模型,Beta · 文本指令 + 图片/视频 → 文本POST /v1/responses限时免费0 积分——