Vizify 音訊工具
AI 音訊工具

為每一位說話者寫好台詞,取回整段對話合成的單一音軌。

把說話者的名稱、依序排列的台詞,以及整段對話推進的方式交給 Vizify。請求只會送到一個有開放多說話者對話模式的模型;在送出之前,Vizify 會先檢查(inspect)該模型支援哪些參數,並且只傳送清單上確實列出的項目,最後回到你手上的,是一段收錄多位說話者、最後合成為單一音軌的完整對話。

多說話者對話模式:每次都會在工作開始前先確認 說話者名稱、發言順序與節奏全部由你在需求中指定 回傳一個多說話者對話音訊成果,並保存下來供你隨時播放
從不完整的想法開始選填項目能協助 Vizify 更快理解交付需求。
試試這些開場方式

送出之後,需求會先在 Vizify 中開啟供你確認,確認無誤才會開始生成。

你提供

你寫下的需求:說話者的名稱、依序排列的台詞,以及整段對話推進的方式

關於說話者名稱、發言順序與節奏的具體指示與偏好

希望明確排除在外的內容,例如彼此重疊的發言,或你從未指名過的額外說話者

Vizify 交付

一個多說話者對話音訊成果

一段收錄多位說話者、最後合成為單一音軌的完整對話

完成後可以直接下載,放進Podcast 試播集、教育訓練情境,或有完整腳本的產品示範使用

功能

從輸入到可直接使用的成果。

Vizify

只走一條路徑:多說話者對話模式

這份需求只會送到有開放多說話者對話模式的模型,不會被轉往其他路徑,因此這個工作真正要求的是一段收錄多位說話者、最後合成為單一音軌的完整對話,而不是某個聽起來相近、實際上不同的東西。想要別種輸出,請改用對應模式的工具。

Vizify

多說話者對話參數會在事前逐項檢查

在工作開始之前,Vizify 會先讀取所選模型目前的參數清單,只有在該模型確實支援的情況下,才會把哪一位說話者使用哪個聲音、發言的先後順序,以及彼此之間的節奏一併傳送出去。不支援的設定會直接被捨棄,而不是換成一個近似值敷衍過去,因此你不會誤以為某個選項已經生效。

Vizify

一路追蹤到多說話者對話檔案完成為止

Vizify 會持續追蹤這個工作,直到它完成或失敗,並把完成的音訊保存下來,讓你可以先自己播放一次、確認每一位說話者在所有輪次中是否都維持同一個聲音,再把成果交給其他人聽;工作失敗時也會如實回報,而不是給你一個半成品。

常見問題

你可能想了解的問題。

使用AI 對話語音產生器會產生什麼樣的成果?

一個範圍明確的工作,最後產出一個檔案:一段收錄多位說話者、最後合成為單一音軌的完整對話。同一次請求不會回傳多個版本讓你挑選。成果是一條對話音軌,不是完整的 Podcast 剪輯,也不保證複製聲音的一致性。

多說話者對話模式實際上會使用哪一個模型?

Vizify 會挑選或檢查(inspect)一個有開放多說話者對話模式的公開模型,並且在送出任何內容之前,先確認它確實接受哪一位說話者使用哪個聲音、發言的先後順序,以及彼此之間的節奏。這個選擇是在執行的當下才完成的,所以本頁不會事先承諾某個特定模型,也不會承諾一個當下可能已經無法使用的路徑。

送出之後音訊會立刻完成嗎?

不會。音訊生成是非同步工作(asynchronous job):Vizify 送出請求之後,會在模型處理期間持續追蹤,並回報完成或失敗,而不是讓頁面一直空轉等待。完成的檔案會保存在這次請求底下,之後隨時都可以回來播放或下載。

說話者名稱、發言順序與節奏可以完全由我自己決定嗎?

可以在需求裡直接寫下哪一位說話者使用哪個聲音、發言的先後順序,以及彼此之間的節奏。每一項只有在檢查過的模型明確列出支援時,才會被傳送出去;模型沒有開放的設定會從請求中略去,而不是用一個近似值頂替過去,因此你看到的成果不會建立在一個沒有被真正套用的設定上。

可以上傳參考音訊,用來影響這段對話音軌的走向嗎?

可以,但需要一個免費的 Vizify 帳戶。最多三個檔案(每個 20 MB)可以用來引導這段對話音軌的音色與質感,讓成果更接近你心中的方向;請只使用你確實擁有權利的音訊。

Vizify 會替這段對話音軌處理權利與授權嗎?

不會。Vizify 不負責任何權利或授權的清算工作。你必須為腳本的內容負責;每位說話者取得的是支援的合成聲音,而不是某個真人的聲音。因此在正式發佈成果、或把它用於商業用途之前,請先自行確認適用的條款。

使用這個頁面需要 Vizify 帳號嗎?

需求可以在未登入的情況下先行公開準備;實際的生成、計費、成果儲存與播放,都要在登入之後才會繼續進行。

在發佈這段對話音軌之前,應該先聽哪些地方?

請完整播放一次,並仔細確認每一位說話者在所有輪次中是否都維持同一個聲音。這個流程不承諾依說話者分開的獨立分軌,或已經剪輯完成的 Podcast,因此如果你的交付結果依賴這一點,請先預留一次剪輯的時間,或改用可以提供該資料的工具。

這個頁面怎麼運作

你寫下說話者的名稱、依序排列的台詞,以及整段對話推進的方式。Vizify 會把它整理成單一的多說話者對話模式請求,讀取所選模型目前的參數清單,並且只用該模型接受的數值把工作送出去。完成的音訊會與這次請求一起保存下來,因此工作一旦回報成功,一段收錄多位說話者、最後合成為單一音軌的完整對話就可以立刻播放,也可以直接下載,不需要重新產生一次。如果工作最後回報失敗,Vizify 會如實顯示失敗狀態,而不是回傳一個勉強湊合的半成品。

你可以控制什麼

需求本身就帶著哪一位說話者使用哪個聲音、發言的先後順序,以及彼此之間的節奏。也請把要排除的內容一起寫清楚:事先指明彼此重疊的發言,或你從未指名過的額外說話者,遠比事後再補救容易得多,因為 Vizify 不會為了達成這件事,去發明一個模型從未開放過的參數;沒有對應參數的要求,只能靠需求文字本身傳達。如果你不確定某個設定是否被支援,直接寫進需求即可,Vizify 會在檢查之後決定要不要傳送。

發佈之前

把成果從頭到尾完整播放一次,並確認每一位說話者在所有輪次中是否都維持同一個聲音。成果是一條對話音軌,不是完整的 Podcast 剪輯,也不保證複製聲音的一致性。這個流程不承諾依說話者分開的獨立分軌,或已經剪輯完成的 Podcast,也不負責權利的清算。你必須為腳本的內容負責;每位說話者取得的是支援的合成聲音,而不是某個真人的聲音。這些都需要在發佈之前自行處理完成。如果成果不如預期,調整需求的描述通常會比重複送出同一份需求更有效。

從需求到可播放音訊

在 Vizify 準備你的下一個音訊成果。

開啟 Vizify