CosyVoice 语音合成测试
零样本声音克隆,上传参考音频即可合成任意声音
服务配置
检测
未检测
合成参数
合成文本
你好,这是 CosyVoice 语音合成测试。我可以克隆任意声音,只需要上传一段参考音频。
😄 笑声
💨 呼吸
💪 强调
⏸️ 长停顿
😂 笑场
提示:点击按钮在光标处插入标记。CosyVoice 支持 [laughter]笑声、[breath]呼吸、<strong>强调</strong> 等控制标记。
情绪预设
自定义
😊 开心(语速快、音量高)
😢 悲伤(语速慢、音量低)
🤩 激动(语速快、音量高)
😌 平静(语速中、音量中)
😐 严肃(语速慢、音量中)
🥰 温柔(语速慢、音量低)
😰 紧张(语速快、音量中)
😴 疲惫(语速慢、音量低)
情绪强度
中
语速
1.0x
音量
1.0x
输出采样率
22050 Hz(语音标准)
44100 Hz(CD音质)
48000 Hz(专业音频)
音频优化
淡入淡出(避免爆音)
参考音频(用于声音克隆)
点击上传或拖拽参考音频到此处
建议 3-10 秒清晰人声,支持 WAV、MP3、M4A、FLAC
或使用麦克风录制参考音频
开始录制
00:00
正在录制...
声音克隆提示:
参考音频质量直接影响合成效果。建议使用 3-10 秒、清晰无背景噪音的单人说话音频。CosyVoice 支持零样本克隆,无需预训练音色。
参考音频文本
(可选,留空自动识别)
开始合成
正在合成语音...
合成结果
下载音频
关闭