私人语音克隆
使用您自己的声音或明确授权克隆的说话者开始语音克隆。登录、完成使用权证明、验证参考并在导出之前测试私有语音身份。
需要登录 · 权利已验证 · 仅账户模式 · MP3 审核

- 更干净克隆的建议参考长度
- 10-60s
- 质量模式涵盖草稿和抛光输出
- 2
- 您的克隆声音可以说的语言组
- 4
- 批准的克隆语音片段的导出格式
- MP3
私人语音克隆在生成之前需要什么
参考资料提供了用于构建不同单词的说话者的声音证据。Fish Voice 将生成的私有模型绑定到登录账户,而不是将其发布到目录中。
授权是第一个输入决策。使用您自己的声音或明确授权克隆人的说话者,然后选择清晰且易于听到讲话的录音。
同意检查点会阻止模型创建,直到您证明有权使用该声音。上传文件并不能代替说话者的许可。
创建后,用人名、不同节奏和您计划使用的另一种语言测试私人声音的稳定性。比较生成结果,修正原文,并只下载已批准的版本。
当说话者的连续性不足以证明私有模型的合理性时,首先 文本转语音 在不提交参考录音的情况下比较公开声音。
从授权参考到经过测试的私人说话者
该演示按顺序显示了实际的门:支持的输入、使用权证明、账户绑定模型创建以及新生成的语音的播放。

添加参考声音
在浏览器中录制或选择授权的 MP3、WAV 或 M4A 语音,然后解决输入中显示的任何持续时间、大小或验证问题。

验证语音授权
仅针对您自己的声音或明确授权克隆的说话者完成使用权证明。

渲染控制镜头
让这个仅在账户内可用的声音读取一句高难度新台词,比较发音和语气,再导出已接受的版本。
私有模型存储
该模型属于您的私人收藏,可用于授权更换系列,而不会出现在公众声音中。
权利第一
在登录用户提交自己的声音或明确授权克隆的说话者的使用权证明之前,Fish Voice 不会启用创建。
草稿和最终渲染选项
使用更快的选项来暴露输入问题,然后在项目需要更完善的审核通过时选择富有表现力的多语言选项。
浏览器录制或上传
使用内置录音机捕获授权语音或上传支持的文件;验证发生在请求可以继续之前。
源音频以适应工作
按照工作区中显示的持续时间和大小规则,以最小噪音准备 MP3、WAV 或 M4A 语音。
可重复使用的克隆语音
返回授权模型进行修正,但审查每个新的渲染;保存的说话者并不能保证新的措辞听起来正确。
四步克隆声音
顺序很重要:证明使用语音的权利,证明参考符合输入规则,创建仅账户模型,然后测试不熟悉的文本并批准输出。
- 01
上传已清除的源音频
使用您自己的或明确授权的语音,使说话者远离音乐和噪音,并遵循显示的上传要求。
- 02
提交使用权证明
仅使用您自己的声音或明确授权克隆的说话者进行操作;否则在创建任何东西之前停止。
- 03
构建私有模型
参考通过验证后,使用显示的积分来创建仅存储在您登录的集合中的模型。
- 04
生成并导出
测试包含真实项目词汇的新句子,聆听同一性和发音问题,并下载已接受的MP3。
当授权说话者必须在录音后返回时
选择私人克隆进行重复工作,其中必须有相同的允许说话者,并且预计未来会发生文本更改;公共或设计的声音可以满足其他选角需求。
长篇叙述克隆
在获得旁白授权的情况下,保持章节的连续性,同时在现场会议结束后处理发音修复和更改的段落。
YouTube 和视频配音
使用经创作者授权的模型补录,将每个替换片段与画面和前后原始旁白一起测试。
播客和简介
仅生成主持人授权的介绍、更正或重复标签,并将其交付与插入前录制的剧集进行比较。
电子学习和培训
获得许可的讲师模型可以修改一个已确定的课程单元,同时课程所有者根据批准的脚本检查术语。
广告和营销
在索赔和报价获得批准后测试授权的品牌说话者变体,并保留哪个系列通过审查的外部记录。
游戏角色
对于配音权被清除的原创角色,试镜分支会在字幕、动画和混音方面发生变化。
本地化配音测试
在将其视为跨市场连续性选择之前,评估授权模型是否可以处理受支持语言的翻译术语。
个人访问声音
使用您自己的录音来创建熟悉的私人语音,然后在分享之前检查每行朗读内容的准确性。
支持语言的语音克隆
私有模型可以使用受支持的英语、中文、日语和韩语脚本进行测试。使用实际翻译的名称和短语来验证一种声音如何传达它们。
英语
美国口音和国际口音。
中文
每个音域都有普通话。
日语
听起来自然的音高重音。
韩语
清脆的现代首尔标准。
语音克隆常见问题解答
规划模型,并明确说明声音权利、账户访问、参考录音验证、积分使用、私有存储、语言测试和发布审核。
语音克隆根据我证明我可能使用的参考创建什么?
Fish Voice 验证提交的录音作为输入,并在您的账户中创建私人模型。在使用权证明之后,该模型可以呈现不同的书面行以供审查。
在我可以测试新单词之前会出现哪些门?
登录,为您自己的声音或明确授权克隆的说话者提供参考音频,通过显示的输入验证,提交使用权证明,并在输入测试副本之前创建带有积分的模型。
什么才是有用的克隆参考?
准备干净自然的语音,音量稳定,背景噪音很小。工作区显示当前的持续时间规则;该页面建议参考 10-60 秒,而不是保证每个文件都会通过。
Fish Voice 如何验证上传的源?
输入接受 MP3、WAV 和 M4A 或浏览器录音。持续时间和文件大小规则在上传时显示,并在模型创建之前由服务器强制执行。
我可以模仿谁的声音?
只能是您自己的声音或讲话者明确许可的声音。所需的同意检查点不会授予权利,也无法使未经授权的录制可接受。
积分在哪里进入私有模型工作流程?
模型创建和语音生成都使用 Fish Voice 积分。创建前检查工作区中当前的成本和账户余额,如果容量不足则比较计划或包。
我应该如何评估多语言输出?
目前流程支持英文、中文、日文、韩文输出。使用真实翻译的术语测试授权模型,并审查每种语言,而不是单独假设同一性以确保准确性。
我什么时候应该在两种质量模式之间切换?
较快的模式适合早期检查输入。若需更成熟的候选版本,建议使用更富表现力的多语言模式;两种模式都仍需在同一操作流程中试听并批准。
商业发布前必须检查什么?
您需要对建模语音和所有项目材料的权利,并且使用仍受 Fish Voice 条款和计划限制。发布前验证客户批准和当前要求。
创建后在哪里可以找到模型?
该模型存储在您的私人账户集合中,而不是公共库中。在“我的语音模型”下对其进行管理,并仅将其重复用于授权脚本。
为什么私有克隆需要登录?
创建需要花费账户积分,并且必须将模型存储在私人收藏中,因此需要登录。在做出决定之前可以试听公共目录样本。
