声音克隆原理

用几十秒到几分钟的语音样本,提取声纹特征,生成指定声音的语音。

主流方案

  1. 商业API:如ElevenLabs,效果最好
  2. 开源模型:如GPT-SoVITS、CosyVoice,可本地部署
  3. 微调方案:基于开源TTS微调音色

应用场景

  • 有声书/播客制作
  • 视频配音
  • 游戏角色语音
  • 语音助手定制

伦理红线

  • 未经同意克隆真人声音:禁止
  • 用于诈骗:违法
  • 冒充他人:危险

建议

用自己或已授权的声音做内容创作,切勿越界。