‹
综合音频生成
Gen
限时免费
🎬 文本到综合音频
用自然语言描述角色与剧本,一次生成人声对白、音效、环境音与背景音乐。台词用 () 描述语气情绪;音效和 BGM 用 [] 包裹。
全局指令 instruction
0/500
角色 roles(音色描述)
0/500
+ 添加角色
剧本 scripts(台词 / 音效 / BGM)
0/1000
+ 添加条目
语速 speed
1.0
音量 volume
1.0
输出格式 response_format
mp3
wav
flac
opus
🎬 生成音频
示例:机场停机坪
示例:广播剧对白
🔊 生成结果
⬇️ 下载音频
就绪
💡 写法说明
roles
:每个角色需 name + description 同时填写或同时留空;描述音色、年龄、说话方式等。
scripts
:台词通过 speaker 关联角色名,text 中可用 () 描述语气、风格、情绪;音效 / BGM 用 [] 包裹且不设 speaker。
instruction 与 roles 合计 ≤ 500 字符,scripts 合计 ≤ 1000 字符。
可在一条指令中描述多个角色及其互动关系,模型会组织对白与声音衔接。