🎨 图工坊
🖼 图生图
📝 文生图
💫 多角度
🎤 声音克隆 v2.1
🧩 拼豆图纸
克隆引擎
🎤 IndexTTS 2.5
🔊 CosyVoice3
🗣 Qwen3-TTS
待上线
🎶 VibeVoice
待上线
✂️ Step EditX
待上线
📝 合成文本
标注多音字
你好,欢迎使用声音克隆工坊。请上传一段参考音频,输入文本,即可克隆声音进行语音合成。
0
/ 5000 字 ·
文字预估:--
🌐 语言
合成语言
中文
英文
日文
阿拉伯语
西班牙语
🎙️ 参考音频
📂 上传音频
📦 内置样本
🎵
点击或拖拽上传参考音频
支持 WAV / MP3 / FLAC / OGG / M4A
加载中...
⏱️ 时长控制
时长系数
−
+
↺
快 ←—— 不变 ———→ 慢
🎭 情感控制方式
与音色参考音频相同
使用情感参考音频
🎭
点击或拖拽上传情感参考音频
情感权重
0.90
使用情感向量控制
😄 开心
😠 愤怒
😢 悲伤
😱 恐惧
😒 厌恶
😪 低落
😮 惊讶
😐 平静
😄 喜
0.00
😠 怒
0.00
😢 哀
0.00
😱 惧
0.00
🤢 厌恶
0.00
😪 低落
0.00
😮 惊喜
0.00
😐 平静
0.00
使用情感描述文本控制
情感随机采样
▶
展开高级采样参数
temperature
0.80
top_p
0.80
top_k
30
num_beams
3
重复惩罚
10.0
长度惩罚
0.0
Mel 上限
1500
分句最大Token数
120
🚀 生成语音
正在生成语音,请稍候...
🎧 生成结果
⬇ 下载
🔄 再次合成
📄 文稿拆分
请粘贴文稿
0
字
每段字数
✂️ 一键拆分
拆分后,每段下方有「插入」按钮,点击可载入左侧合成文本。
拆分结果
(0 段)
粘贴文稿后点击「一键拆分」
🗂️ 上传的音频
清空
点击选用 · 红 ✕ 删除共享样本库文件
加载中...
👤 用户样本
清空
所有引擎共用(IndexTTS / CosyVoice 通用)
加载中...
📜 生成历史
清空
按用户目录保存(与图工坊共用),保留 15 天
暂无生成记录
选择「
」的读音,点击自动插入