‹
语音合成
TTS
Contextual TTS
🎙️ 文本转语音
输入文本,选择音色与参数,生成真人级语音。支持用自然语言指令控制情绪与演绎风格。
模型 model
stepaudio-2.5-tts(Step Plan 可用)
stepaudio-3-tts(需开放平台额度)
音色 voice
文本 input
0/1000
(温柔地,语速偏慢)你好呀,今天天气真好,我们一起出去走走吧。
全局指令 instruction
0/500
语速 speed
1.0
音量 volume
1.0
格式 format
mp3
wav
flac
opus
采样率 sample_rate
24000(默认)
16000
22050
48000
流式生成 + 逐词字幕高亮(stream_format=sse, timestamp=true)
✨ 生成语音
示例:情感播报
示例:中英混说
🔊 合成结果
⬇️ 下载音频
就绪