AI 聲音克隆

帳號專用的聲音克隆

請使用你自己的聲音,或說話者已明確授權克隆的聲音,開始聲音克隆。登入、完成使用權聲明、驗證參考音,匯出前先測試這條私人聲線。

需登入 · 已聲明權利 · 帳號專用模型 · MP3 審核

帳號內的 Fish Voice 克隆畫面,含已提交的參考音、使用權聲明,以及等待稿件測試的私人模型
建議的參考長度,克隆會比較乾淨
10-60s
涵蓋草稿與較精緻輸出的品質模式
2
克隆聲線可說的語言群組
6
核准克隆語音版本的匯出格式
MP3

私人聲音克隆在生成前需要什麼

參考音提供建立聲線所需的聲音特徵,讓模型能朗讀不同文字。Fish Voice 會將產生的私人模型綁定至已登入帳號,而不會公開到目錄。

授權是第一個輸入決定。請使用你自己的聲音,或說話者已明確授權克隆的聲音,再選一段口齒清楚、容易聽清的錄音。

同意檢查點會在你聲明有權使用該聲音前,擋住模型建立。上傳檔案不能代替說話者的許可。

建立後,用名字、節奏與你打算使用的另一種語言挑戰這條私人聲線。比較生成結果、修正來源,只下載通過的版本。

若聲線延續性還不值得做私人模型,先從 文字轉語音 比較公開候選,不必提交參考錄音。

從已授權參考音到通過測試的私人聲線

下列示範依實際流程排列:加入支援的輸入、提交使用權聲明、建立帳號專用模型,以及播放新生成的語音。

已提交的參考音進入 Fish Voice 輸入驗證,聲音克隆即將建立私人模型

加入參考聲音

在瀏覽器錄音,或選已授權的 MP3、WAV、M4A 語音,並處理輸入處顯示的時長、大小或驗證問題。

開始建立私人模型前,必須完成使用權同意聲明

聲明聲音授權

使用權同意聲明只能用於你自己的聲音,或說話者已明確授權克隆的聲音。

下載 MP3 前,用私人聲線測試新句子

生成受控版本

讓這條帳號專用聲線讀一句難的新台詞,比較發音與語氣,再匯出你接受的那一條。

圍繞帳號專用克隆模型的控制項

私人克隆流程以授權與重複使用為核心:驗證已授權來源、聲明同意、在帳號內建立模型,並檢查每句生成結果。

開啟聲音克隆

私人模型儲存

模型屬於你的私人收藏,可用於已授權的替換台詞,而不會出現在公開聲線中。

權利優先

Fish Voice 會等到已登入使用者針對自己的聲音,或說話者已明確授權克隆的聲音,提交使用權聲明後,才開放建立模型。

草稿與最終生成選項

先用較快的選項找出輸入問題;專案需要更完整的審聽版本時,再選表現力較高的多語選項。

瀏覽器錄音或上傳

用內建錄音器擷取已授權語音,或上傳支援的檔案;驗證通過後請求才能繼續。

符合任務的來源音訊

準備音量穩定、雜訊少的 MP3、WAV 或 M4A 語音,並遵守工作區顯示的時長與大小規則。

可重複使用的克隆語音版本

可回到已授權模型做修正,但每句新生成都要再聽;儲存聲線不保證新用字一定合適。

四步驟完成聲音克隆

順序很重要:聲明有權使用該聲音、確認參考音符合輸入規則、建立帳號專用模型,再用不熟悉的文字測試並核准輸出。

  1. 01

    上傳已取得授權的來源音訊

    請使用你自己的錄音,或說話者已明確授權的錄音;錄音中應避免音樂與雜訊,並遵守畫面上的上傳要求。

  2. 02

    提交使用權聲明

    只有使用你自己的聲音,或說話者已明確授權克隆的聲音時,才能繼續;否則請勿建立模型。

  3. 03

    建立私人模型

    參考音通過驗證後,消耗顯示的點數,建立只會儲存在已登入帳號私人收藏中的模型。

  4. 04

    生成並匯出

    用參考音中沒有出現、但含真實專案詞彙的新句子測試,檢查聲線特徵與發音問題,再下載通過的 MP3。

需要讓已授權說話者在錄音後持續配音時

當專案必須維持同一位已授權說話者,且預期之後仍會修改文字時,可選擇私人克隆;其他選角需求則可使用公開或設計聲線。

長篇旁白克隆

取得旁白授權後,在現場場次之後處理發音修正與改寫段落,同時維持章節一致性。

YouTube 與影片旁白

用創作者核准的模型做補錄,每段替換都對著畫面與前後原旁白測試。

Podcast 與開場

只生成主持人授權的開場、修正或固定標籤,插入前先和已錄集數比對讀法。

線上課程與訓練

獲准的講師模型可修訂單一可辨識課程單元,課程擁有者再把術語對上已核准稿件。

廣告與行銷

主張與優惠核准後,測試已授權品牌聲線變體,並在外部留下哪一句通過審核的紀錄。

遊戲角色

原創角色的聲音權利已釐清時,在建置中搭配字幕、動畫與混音試聽分支改動。

在地化配音測試

先評估已授權模型能否處理支援語言中的譯詞,再把它當成跨市場的一致性選擇。

個人無障礙聲線

用你自己的錄音建立熟悉的私人語音,分享前再核對每一句朗讀是否正確。

支援語言的聲音克隆

私人模型可用支援的英語、中文、日語、韓語、西班牙語與葡萄牙語稿件測試。請用實際譯名與片語,確認同一條聲線如何跨語言承載。

英語

美式與國際口音。

中文

各種語域的華語。

日語

聽起來自然的高低重音。

韓語

俐落、現代的首爾標準。

西班牙文

涵蓋不同地區口音的西班牙語聲音。

葡萄牙文

自然流暢的巴西葡萄牙語聲音。

準備多語批次前,請在克隆工作區確認目前的語言選項與生成費用。

聲音克隆常見問題

用清楚的答案規劃模型:說話者權利、帳號權限、來源驗證、點數使用、私人儲存、語言測試與發布審核。

我聲明有權使用的參考音,聲音克隆會做成什麼?

Fish Voice 會驗證提交的錄音是否符合輸入要求,並在你的帳號建立私人模型。完成使用權聲明後,該模型就能朗讀不同文字供你審核。

測試新詞前需要完成哪些步驟?

先登入,提交你自己的聲線參考音,或說話者已明確授權克隆的參考音,通過畫面上的輸入檢查,完成使用權同意聲明,並使用點數建立模型後,才能輸入測試稿。

怎樣的克隆參考音比較有用?

準備音量穩定、背景雜訊少的自然語音。工作區會顯示目前時長規則;本頁建議 10-60 秒參考,但不保證每個檔案都能通過。

Fish Voice 如何驗證上傳的來源?

輸入接受 MP3、WAV、M4A 或瀏覽器錄音。時長與檔案大小規則會在上傳時顯示,並由伺服器在建立模型前執行。

我可以為誰的聲音建模?

只能是你自己的聲音,或說話者已明確許可的聲音。必要的同意檢查點不會授予權利,也不能讓未授權錄音變得可接受。

點數在私人模型流程的哪裡出現?

建立模型與語音生成都會使用 Fish Voice 點數。建立前請在工作區查看目前費用與帳號餘額,容量不足再比較方案或點數包。

該如何評估多語輸出?

目前流程支援英語、中文、日語、韓語、西班牙語與葡萄牙語輸出。用真實譯詞測試已授權模型,並讓各語言都經過審聽;不要因為聲線特徵一致,就假設用詞一定正確。

兩種品質模式該何時切換?

較快模式適合早期輸入檢查;表現力較高的多語模式則適合製作更完整的審聽版本。兩者都仍需在同一組控制項中試聽並核准。

商用發布前必須檢查什麼?

你必須擁有使用該建模聲音及所有專案素材所需的權利。使用仍受 Fish Voice 條款與方案限制約束。發布前請確認客戶核准與現行要求。

建立後要在哪裡找到模型?

模型存在你的私人帳號收藏,不在公開語音庫。到「我的語音模型」管理,且只用於已授權稿件。

為什麼私人克隆需要登入?

建立會消耗帳號點數,且必須把模型存進私人收藏,所以需要登入。做這個決定前,仍可試聽公開目錄樣本。

建立你的專屬私人聲線

使用你自己的錄音,或說話者已明確授權克隆的錄音。登入並完成使用權同意聲明,為已授權文字建立帳號專用聲線。