帳號專用的聲音克隆
請使用你自己的聲音,或說話者已明確授權克隆的聲音,開始聲音克隆。登入、完成使用權聲明、驗證參考音,匯出前先測試這條私人聲線。
需登入 · 已聲明權利 · 帳號專用模型 · MP3 審核

- 建議的參考長度,克隆會比較乾淨
- 10-60s
- 涵蓋草稿與較精緻輸出的品質模式
- 2
- 克隆聲線可說的語言群組
- 6
- 核准克隆語音版本的匯出格式
- MP3
私人聲音克隆在生成前需要什麼
參考音提供建立聲線所需的聲音特徵,讓模型能朗讀不同文字。Fish Voice 會將產生的私人模型綁定至已登入帳號,而不會公開到目錄。
授權是第一個輸入決定。請使用你自己的聲音,或說話者已明確授權克隆的聲音,再選一段口齒清楚、容易聽清的錄音。
同意檢查點會在你聲明有權使用該聲音前,擋住模型建立。上傳檔案不能代替說話者的許可。
建立後,用名字、節奏與你打算使用的另一種語言挑戰這條私人聲線。比較生成結果、修正來源,只下載通過的版本。
若聲線延續性還不值得做私人模型,先從 文字轉語音 比較公開候選,不必提交參考錄音。
從已授權參考音到通過測試的私人聲線
下列示範依實際流程排列:加入支援的輸入、提交使用權聲明、建立帳號專用模型,以及播放新生成的語音。

加入參考聲音
在瀏覽器錄音,或選已授權的 MP3、WAV、M4A 語音,並處理輸入處顯示的時長、大小或驗證問題。

聲明聲音授權
使用權同意聲明只能用於你自己的聲音,或說話者已明確授權克隆的聲音。

生成受控版本
讓這條帳號專用聲線讀一句難的新台詞,比較發音與語氣,再匯出你接受的那一條。
私人模型儲存
模型屬於你的私人收藏,可用於已授權的替換台詞,而不會出現在公開聲線中。
權利優先
Fish Voice 會等到已登入使用者針對自己的聲音,或說話者已明確授權克隆的聲音,提交使用權聲明後,才開放建立模型。
草稿與最終生成選項
先用較快的選項找出輸入問題;專案需要更完整的審聽版本時,再選表現力較高的多語選項。
瀏覽器錄音或上傳
用內建錄音器擷取已授權語音,或上傳支援的檔案;驗證通過後請求才能繼續。
符合任務的來源音訊
準備音量穩定、雜訊少的 MP3、WAV 或 M4A 語音,並遵守工作區顯示的時長與大小規則。
可重複使用的克隆語音版本
可回到已授權模型做修正,但每句新生成都要再聽;儲存聲線不保證新用字一定合適。
四步驟完成聲音克隆
順序很重要:聲明有權使用該聲音、確認參考音符合輸入規則、建立帳號專用模型,再用不熟悉的文字測試並核准輸出。
- 01
上傳已取得授權的來源音訊
請使用你自己的錄音,或說話者已明確授權的錄音;錄音中應避免音樂與雜訊,並遵守畫面上的上傳要求。
- 02
提交使用權聲明
只有使用你自己的聲音,或說話者已明確授權克隆的聲音時,才能繼續;否則請勿建立模型。
- 03
建立私人模型
參考音通過驗證後,消耗顯示的點數,建立只會儲存在已登入帳號私人收藏中的模型。
- 04
生成並匯出
用參考音中沒有出現、但含真實專案詞彙的新句子測試,檢查聲線特徵與發音問題,再下載通過的 MP3。
需要讓已授權說話者在錄音後持續配音時
當專案必須維持同一位已授權說話者,且預期之後仍會修改文字時,可選擇私人克隆;其他選角需求則可使用公開或設計聲線。
長篇旁白克隆
取得旁白授權後,在現場場次之後處理發音修正與改寫段落,同時維持章節一致性。
YouTube 與影片旁白
用創作者核准的模型做補錄,每段替換都對著畫面與前後原旁白測試。
Podcast 與開場
只生成主持人授權的開場、修正或固定標籤,插入前先和已錄集數比對讀法。
線上課程與訓練
獲准的講師模型可修訂單一可辨識課程單元,課程擁有者再把術語對上已核准稿件。
廣告與行銷
主張與優惠核准後,測試已授權品牌聲線變體,並在外部留下哪一句通過審核的紀錄。
遊戲角色
原創角色的聲音權利已釐清時,在建置中搭配字幕、動畫與混音試聽分支改動。
在地化配音測試
先評估已授權模型能否處理支援語言中的譯詞,再把它當成跨市場的一致性選擇。
個人無障礙聲線
用你自己的錄音建立熟悉的私人語音,分享前再核對每一句朗讀是否正確。
支援語言的聲音克隆
私人模型可用支援的英語、中文、日語、韓語、西班牙語與葡萄牙語稿件測試。請用實際譯名與片語,確認同一條聲線如何跨語言承載。
英語
美式與國際口音。
中文
各種語域的華語。
日語
聽起來自然的高低重音。
韓語
俐落、現代的首爾標準。
西班牙文
涵蓋不同地區口音的西班牙語聲音。
葡萄牙文
自然流暢的巴西葡萄牙語聲音。
聲音克隆常見問題
用清楚的答案規劃模型:說話者權利、帳號權限、來源驗證、點數使用、私人儲存、語言測試與發布審核。
我聲明有權使用的參考音,聲音克隆會做成什麼?
Fish Voice 會驗證提交的錄音是否符合輸入要求,並在你的帳號建立私人模型。完成使用權聲明後,該模型就能朗讀不同文字供你審核。
測試新詞前需要完成哪些步驟?
先登入,提交你自己的聲線參考音,或說話者已明確授權克隆的參考音,通過畫面上的輸入檢查,完成使用權同意聲明,並使用點數建立模型後,才能輸入測試稿。
怎樣的克隆參考音比較有用?
準備音量穩定、背景雜訊少的自然語音。工作區會顯示目前時長規則;本頁建議 10-60 秒參考,但不保證每個檔案都能通過。
Fish Voice 如何驗證上傳的來源?
輸入接受 MP3、WAV、M4A 或瀏覽器錄音。時長與檔案大小規則會在上傳時顯示,並由伺服器在建立模型前執行。
我可以為誰的聲音建模?
只能是你自己的聲音,或說話者已明確許可的聲音。必要的同意檢查點不會授予權利,也不能讓未授權錄音變得可接受。
點數在私人模型流程的哪裡出現?
建立模型與語音生成都會使用 Fish Voice 點數。建立前請在工作區查看目前費用與帳號餘額,容量不足再比較方案或點數包。
該如何評估多語輸出?
目前流程支援英語、中文、日語、韓語、西班牙語與葡萄牙語輸出。用真實譯詞測試已授權模型,並讓各語言都經過審聽;不要因為聲線特徵一致,就假設用詞一定正確。
兩種品質模式該何時切換?
較快模式適合早期輸入檢查;表現力較高的多語模式則適合製作更完整的審聽版本。兩者都仍需在同一組控制項中試聽並核准。
商用發布前必須檢查什麼?
你必須擁有使用該建模聲音及所有專案素材所需的權利。使用仍受 Fish Voice 條款與方案限制約束。發布前請確認客戶核准與現行要求。
建立後要在哪裡找到模型?
模型存在你的私人帳號收藏,不在公開語音庫。到「我的語音模型」管理,且只用於已授權稿件。
為什麼私人克隆需要登入?
建立會消耗帳號點數,且必須把模型存進私人收藏,所以需要登入。做這個決定前,仍可試聽公開目錄樣本。
