声音设计
通过文字描述目标音色,生成对应语音(演示使用浏览器语音引擎模拟)。
声音克隆
上传参考音频,克隆其音色(模拟流程,实际发音仍为浏览器引擎)。
🎤 点击或拖拽上传参考音频(3–10 秒,wav/mp3/m4a)
演示环境仅解析文件信息,不提取音色
演示环境仅解析文件信息,不提取音色
极致克隆
少量音频 + 参考文本即可克隆音色(模拟流程)。
🎤 上传参考音频(3–10 秒)
剧本配音
多角色对话剧本,自动分配说话人并批量生成(模拟流程,按角色顺序播放)。
续写生成
给定前缀文本,模型自动续写并合成为语音(模拟流程)。
续写结果:
LoRA 管理
查看与管理音色 LoRA 列表。
LoRA 名称状态操作
lora_温柔女主播_v3已就绪
lora_游戏解说_热血已就绪
lora_纪录片旁白训练中…
lora_电台深夜档已下载
LoRA 训练
用自定义数据集微调音色 LoRA(模拟训练流程)。
IndexTTS 2.0 · 克隆合成
零样本音色克隆引擎(模拟流程)。
🎤 上传参考音频
IndexTTS 2.0 · 情感控制
通过情感标签控制合成语气(模拟流程)。
IndexTTS 2.0 · 时长控制
指定目标时长,自动调整语速生成(模拟流程)。
dots.tts · 快速克隆
轻量引擎低延迟快速克隆(模拟流程,参考音频 2–5 秒即可)。
🎤 上传参考音频
系统设置
引擎状态与运行参数(模拟信息)。
引擎状态
VoxCPM2 ● 已加载
声音设计 / 克隆 / 剧本配音 / LoRA
VRAM 5.6 GB · FP16
IndexTTS 2.0 ● 已加载
零样本克隆 / 情感 / 时长控制
VRAM 3.2 GB · FP16
dots.tts ● 模拟
轻量快速克隆
VRAM 0.9 GB · INT8
运行参数(模拟)
OpenAI 兼容 API(模拟)
POST /v1/audio/speech
{ "model": "voxcpm2", "input": "…", "voice": "demo" }
→ 演示环境仅展示接口结构,不提供真实调用
{ "model": "voxcpm2", "input": "…", "voice": "demo" }
→ 演示环境仅展示接口结构,不提供真实调用
历史记录
全部合成记录,支持搜索、筛选、重播与删除。
音色库
自定义音色管理:保存、应用、收藏与删除(模拟数据)。
帮助
使用说明、快捷键与常见问题。
快速上手
1️⃣ 声音设计:输入文本 → 调整语速/音调/情感 → 合成试听
2️⃣ 声音克隆:上传 3–10 秒参考音频 → 输入文本 → 克隆合成
3️⃣ 剧本配音:添加多角色台词 → 开始配音 → 按顺序播放全部
4️⃣ 音色库:把满意的音色描述保存下来,随时应用
2️⃣ 声音克隆:上传 3–10 秒参考音频 → 输入文本 → 克隆合成
3️⃣ 剧本配音:添加多角色台词 → 开始配音 → 按顺序播放全部
4️⃣ 音色库:把满意的音色描述保存下来,随时应用
快捷键
Ctrl + K命令面板
Esc关闭弹层 / 抽屉
常见问题
为什么播放的是系统声音而不是克隆音色?▾
演示站无法运行真实模型,发声由浏览器 Web Speech API 完成;真实系统会加载 VoxCPM2/IndexTTS2 权重并克隆参考音频音色。
支持的音频格式?▾
wav / mp3 / m4a / flac / ogg;参考音频建议 3–10 秒、干净无背景噪音。
剧本配音支持多少角色?▾
不限数量;每个角色可分配不同音色(旁白/男主/女主/老人/小孩/机器人等)。