AI 声音克隆
声音克隆
上传一小段参考音频,复刻音色,再用它合成任意文本
常见问题
声音克隆怎么用?
你上传一段短而干净的参考样本,工具克隆这个声音,然后用它念出你输入的任意文字。克隆质量几乎完全由这段样本决定,所以录得干净比录得长重要得多。
参考音频要多长?
10~20 秒的清晰片段最好——足够抓住自然的节奏和语调,又不必更长。它应是单声道、至少 24kHz,可到 60 秒或 10MB,但一段短而干净的样本永远胜过又长又吵的。
怎么收费?
克隆和合成都通过兑换码按量计费,无需账号。用多少付多少,试一段样本花不了多少。
样本要什么格式和质量?
WAV、MP3 或 M4A 都行,最好单声道、至少 24kHz,含 10~20 秒清晰人声(最长 60 秒、10MB)。一个人在安静房间里正常说话、没有音乐和背景噪音,克隆最自然。
克隆出来不像或发闷怎么办?
几乎都是样本的锅,不是工具。背景噪音、房间回声、或录太大导致的爆音,都会被一起复制进克隆。换个小而软的空间重录一段更干净的,效果通常大幅改善。
可以克隆谁的声音?
只能是你自己的声音,或明确同意的人。未经本人同意克隆他人声音不被允许,也会惹上真麻烦——那不是这个工具的用途。
克隆声音有多自然?
用干净的 10~20 秒样本,克隆能贴近原声的音色和语气。真正的考验是输入一句样本里没有的话再听——新词才见真章,因为给过的短语任何工具都能回放。