在浏览器中自然文本转语音
使用人们会听到的确切单词开始文本转语音。比较说话者、检查姓名和时间、修改来源并保存批准的 MP3。
基于浏览器·定向·多语言·导出就绪

- 可供试听的公共语音风格
- 300+
- 当前目录中的语言组
- 6
- 用于快速语音检查的示例字符
- 120
- 每个批准的镜头的导出格式
- MP3
文本转语音会产生什么以及您仍在评论什么
文本转语音提供从书面输入中提取的口头内容。它并不决定所选择的说话者、语速、发音和重音是否符合最终的语境;这些选择权仍由编辑决定。
在完整脚本之前准备一个控制摘录。包括一个专有名词、一个数字和最长的句子,以便早期试镜首先发现最昂贵的问题。
浏览器生成使更正接近源。当指令或场景发生变化时,更新该特定块,渲染替换,并将其与周围接受的音频进行比较。
当速度很重要时,从公众的声音开始。设计的合成说话者遵循原始方向,而私人克隆仅在您控制或获得其录音许可时才适用。
需要一位经常性的私人说话者吗?继续 声音克隆 确认源语音的权限后。
观看文本转语音工作流程
演示遵循单一批准路径:准备好的输入、经过深思熟虑的说话者选择、关键回放以及为项目做好准备的 MP3。

写下该行
粘贴最终的口头副本而不是编辑者的注释,并标记需要特别注意的名称、缩写或数字。

直接发货
在为较长文本消耗积分前,先用一段最能暴露问题的文本,比较目标语言下的公开声音。

批准音频
在实际使用场景中试听,如果念读效果不佳就修正输入,并将已通过的版本下载为 MP3。
交付由您掌控
转换和标点符号对阅读的影响不同。单独测试每个更改,以便了解说话者或句子是否解决了问题。
专为多语言脚本而构建
在批准本地化屏幕或课程的旁白之前,试听英语、中文、日语、韩语、西班牙语或葡萄牙语的实际翻译术语。
实用说话者候选名单
筛选公开声音库,建立一份精简的候选声音列表,并让每个选项读取相同的测试台词以便公平比较。
准备出口的资产
播放支持导出前的批准,而生成历史记录可帮助以后的替换遵循早期文件中使用的语音。
低成本预览轮次
把第一遍花在最难的句子上。在完整的部分消耗更多积分之前,进行一个小测试来发现选角和发音问题。
为间隙而设计的声音
当目录错过简报时描述原始说话者,或选择从授权录音构建的仅限账户的克隆。
如何将文本转换为语音
四个检查点将书面材料变成可用资产:准备难读文本,据此比较声音,在实际上下文中检查生成结果,并在批准后导出。
- 01
编写脚本
在自然修改点划分文案,并包含观众必须正确听到的名称、缩写词、数字和标点符号。
- 02
选择语音方向
根据项目需要试听目录资料、选择授权的私人模型或指导原创合成说话者。
- 03
渲染定向镜头
生成一小部分并聆听其预期的视觉或交互,检查术语、停顿和总体持续时间。
- 04
批准并下载
更正源或转换选择,重新生成受影响的部分,并仅在接受新通道后下载 MP3。
受益于脚本级音频修订的项目
当工作以可审阅的文本单元形式到达并且稍后的更正应该替换一个音频片段而不是重新开始制作时,文本转语音是最实用的。
短视频旁白
按场景生成,将各版念读放到画面中比较,并替换时长不再匹配剪辑的开场钩子或过渡。
电子学习和培训
将每个旁白块与幻灯片或课程 ID 相关联,以便策略更新生成一个明确标识的替换文件。
播客和简介
将介绍、批准的赞助商副本、更正和过渡保留为单独的模块,可以在主持人录音旁边检查。
长篇口语故事
使用包含对话和困难术语的段落,记录发音决定,并批准指定章节部分的输出。
朗读访问曲目
按阅读顺序镜像已批准的来源,验证标题和链接,并提供音频作为伴随而不是替代。
广告和营销
当审阅者比较多个脚本变体的授权声明、报价和号召性用语时,请保持声音稳定。
IVR 和语音座席
渲染完整的交互分支,监听不明确的选择或过长的持续时间,修复工程集成前的提示。
游戏和角色
尽早将原始角色台词放入构建中,在对话批准之前评估字幕、动画、触发器和混音。
六种语言组的文本转语音
当前目录包括英语、中文、日语、韩语、西班牙语和葡萄牙语声音。在安排本地化生产批次之前,请确认目标语言并试听项目术语。
英语
来自美国及其他地区的口音。
中文
普通话适合每个音域。
日语
自然的音调读起来。
韩语
现代、清晰的首尔标准。
西班牙语
覆盖不同地区口音的西班牙语声音。
葡萄牙语
自然流畅的巴西葡萄牙语声音。
文本转语音常见问题解答
有关准备源文本、选择说话者、了解账户限制、检查权限以及决定生成的语音何时准备好离开 Fish Voice 的答案。
文本变成语音后还需要做什么决定?
转换只会产生一个候选念读版本,不代表最终编辑结论。导出前仍需确认选角、时序、发音、含义,以及是否适合实际发布场景。
新账户如何测试说话者的选择?
欢迎积分支持短文本转语音试听。先用一句高难度测试台词;订阅和预付积分包可用于更长文案和其他语音工作流程。
什么是可靠的脚本到音频序列?
准备分段文本,用同一段摘录比较候选声音,完成一轮受控生成,在实际上下文中试听,并只重新生成未通过审核的部分。
如何判断朗读是否自然?
不要依赖目录样本。播放您自己的句子并检查停顿、强调、名称和句子长度,因为这些输入选择会影响交付。
我现在可以试听哪些语言组?
Fish Voice 目前提供英语、中文、日语、韩语、西班牙语和葡萄牙语选项。请在公共声音库中查看可用声音,并直接测试翻译后的术语。
已接受的拍摄会发生什么情况?
下载项目已批准的 MP3。当后续副本需要相关替换时,生成历史记录会保留对早期输出的引用。
在商业出版之前我应该清楚什么?
查看 Fish Voice 条款和当前计划限制,保留脚本和其他源材料的权利,并仅在语音所有者授权的情况下使用私人克隆。
私人模型什么时候是合适的说话者来源?
使用您自己的声音的私人模型或明确授权克隆的说话者。创建后,新脚本可以选择仅账户模型。
TTS 与更广泛的语音工作区有何不同?
TTS 是写入输入转换。Fish Voice 还提供目录试听、设计声音、授权私人模型、播放、导出和围绕该步骤的生成历史记录。
浏览器和账户有哪些要求?
该编辑器不需要桌面安装。Generation 需要一个账户,使用欢迎或付费积分,并将保存的私人语音与生成历史记录连接起来。
