English, Chinese (中文), Japanese (日本語), German (Deutsch), French (Français), Spanish (Español), Korean (한국어), Arabic (العربية), Russian (Русский), Dutch (Nederlands), Italian (Italiano), Polish (Polski), Portuguese (Português)
声音克隆
点击或拖拽文件到此区域上传
格式: mp3/wav/m4a/mp4/mov, 大小: 不超过 500MB
时长: 最少 10秒,最多 60秒
- 1选择克隆模型A2E, A2E-V2, Cartesia, MiniMax, Elevenlabs
- 2选择目标语言系统会根据您的界面语言自动选择,也可手动调整
- 3上传音频文件单人、人声清晰、无背景噪音、音量一致,建议使用无背景噪音的高采样率wav文件
- 4设置基本信息输入声音名称
- 5开始训练通常在2分钟内完成
Chinese (中文), English, German (Deutsch), Italian (Italiano), Portuguese (Português), Spanish (Español), Japanese (日本語), Korean (한국어), French (Français), Russian (Русский)
English, Chinese (中文), French (Français), German (Deutsch), Spanish (Español), Portuguese (Português), Japanese (日本語), Hindi (हिन्दी), Italian (Italiano), Korean (한국어), Dutch (Nederlands), Polish (Polski), Russian (Русский), Swedish (Svenska), Turkish (Türkçe)
Chinese (中文), Chinese,Yue (粤语), English, Arabic (العربية), Russian (Русский), Spanish (Español), French (Français), Portuguese (Português), German (Deutsch), Turkish (Türkçe), Dutch (Nederlands), Ukrainian (Українська), Vietnamese (Tiếng Việt), Indonesian (Bahasa Indonesia), Japanese (日本語), Italian (Italiano), Korean (한국어), Thai (ไทย), Polish (Polski), Romanian (Română), Greek (Ελληνικά), Czech (Čeština), Finnish (Suomi), Hindi (हिन्दी), Bulgarian (Български), Danish (Dansk), Hebrew (עברית), Malay (Bahasa Melayu), Persian (فارسی), Slovak (Slovenčina), Swedish (Svenska), Croatian (Hrvatski), Filipino, Hungarian (Magyar), Norwegian (Norsk), Slovenian (Slovenščina), Catalan (Català), Nynorsk, Tamil (தமிழ்), Afrikaans
English (USA), Chinese (中文), English (UK), English (Australia), English (Canada), Japanese (日本語), German (Deutsch), Hindi (हिन्दी), French (France) (Français (France)), French (Canada) (Français (Canada)), Korean (한국어), Portuguese (Brazil) (Português (Brasil)), Portuguese (Portugal) (Português (Portugal)), Italian (Italiano), Spanish (Spain) (Español (España)), Spanish (Mexico) (Español (México)), Indonesian (Bahasa Indonesia), Dutch (Nederlands), Turkish (Türkçe), Filipino, Polish (Polski), Swedish (Svenska), Bulgarian (Български), Romanian (Română), Arabic (Saudi Arabia) (العربية (السعودية)), Arabic (UAE) (العربية (الإمارات)), Czech (Čeština), Greek (Ελληνικά), Finnish (Suomi), Croatian (Hrvatski), Malay (Bahasa Melayu), Slovak (Slovenčina), Danish (Dansk), Tamil (தமிழ்), Ukrainian (Українська), Russian (Русский)
可重复使用的自定义声音
用你自己的声音样本创建可重复使用的 AI 声音
训练自定义声音,用于旁白、本地化内容、原型和持续性的音频制作。你可以按需选择可用的声音模型和语言,不必受不同模型语言数量差异的限制。
- 10–60 秒声音样本
- 音频或视频最大 500 MiB
- 语言支持因模型而异
如何克隆声音
- 添加声音样本. 录制或上传一段清晰的 10–60 秒 MP3、WAV、M4A、MP4 或 MOV 样本。
- 选择训练选项. 为声音命名,选择模型和支持的语言,并可按需降低背景噪声。
- 训练并重复使用声音. 开始训练,试听已完成的声音,然后在文本转语音流程中选择它。
选择合适的 AI 声音克隆模型
可在同一流程中比较 A2E、A2E-V2、Cartesia、MiniMax 和 ElevenLabs。每个模型支持的语言和训练费用不同,请先选择模型,再从其支持的语言中选择目标语言,并在正式使用前试听结果。
克隆声音可以用来制作什么?
当脚本、内容形式或目标语言发生变化时,可重复使用的 AI 声音能帮助你保持一致的听感。
- 视频配音. 为产品视频、教程、社交短片和持续更新的频道内容制作旁白,无需每次修改都重新录音。
- 播客与有声书. 生成旁白、修正某句话或更新节目,同时保持相同的声音特征。
- 多语言本地化. 使用同一个具有辨识度的声音生成模型支持的目标语言,用于本地化营销和学习内容。
- 原型与教育内容. 为产品演示、演讲、课程和无障碍原型添加一致的语音。
如何获得更准确的声音克隆效果
请使用只有一位说话者、语速自然、音量稳定且回声和背景音乐较少的清晰录音。避免多人重叠说话、过度压缩、音效和长时间静音。编辑器会检查时长,提供可选降噪,并显示所选模型支持的语言。训练后请务必先试听。
授权与负责任的声音克隆
仅克隆你自己的声音或已获授权使用的声音。切勿将合成音频冒充未经本人同意的真实言论。
声音克隆常见问题
声音样本应该多长?
当前声音克隆编辑器接受一段 10–60 秒的样本。
可以上传哪些文件格式?
你可以上传 MP3、WAV、M4A、MP4 或 MOV 文件,当前最大文件大小为 500 MiB。
支持哪些语言?
可用语言取决于所选的声音模型。切换模型时,编辑器会同步更新语言列表。
克隆声音需要获得许可吗?
需要。只能上传或录制你拥有或已获许可使用的声音,也不要用克隆声音冒充他人或误导他人。
AI 声音克隆是如何工作的?
声音克隆模型会分析样本中的音色、音高、节奏、发音和说话风格等特征,再创建一个可以朗读新文本的可重复使用声音。
声音克隆训练需要多久?
训练通常会在约两分钟内完成,实际时间可能因所选模型和当前服务器负载而有所不同。
如何让克隆声音更像原声?
请在安静环境中保持固定麦克风距离和稳定音量,由一位说话者自然朗读完整句子,并尽量减少回声。只有源文件确实含有背景噪声时再尝试降噪。
克隆声音可以说其他语言吗?
可以,前提是所选模型支持目标语言。你可以切换模型比较语言范围,并试听结果,因为不同模型和语言的发音及相似度可能不同。
训练后的声音可以在哪里使用?
训练完成后,可在“我的结果”中试听,并在文本转语音流程中选择该声音,用于旁白和其他已获授权的音频项目。