林亦LYi
25-03-17 18:47 微博认证:数码博主 微博原创视频博主

Seed-VC语音克隆模型三大核心功能 #AI创造营#

1. 零样本语音转换
仅需1-30秒参考音频即可克隆声音,无需任何训练。支持实时语音转换(算法延迟约300ms+设备延迟100ms)和歌声转换,适用于在线会议/游戏/直播场景。

2. 极速部署能力
30秒内完成声音克隆,最低仅需1条语音样本。在T4显卡上微调训练仅需2分钟(最少100步),大幅降低使用门槛。

3. 多场景应用支持
实时语音:300ms超低延迟技术
歌声转换:保留音色特征的音乐生成
个性优化:支持通过少量数据微调模型,提升特定说话人表现

项目地址:http://t.cn/A6BolK6o http://t.cn/A6BolCXG

发布于 日本