文字完全在裝置端使用 Piper 或 Kokoro 語音模型,透過 ONNX Runtime(標準或串流)進行合成 - 無需網際網路連線、無需 API 金鑰,也不會將任何資料傳送到外部。產生的 PCM 音訊可直接與 Runtime Audio Importer 整合,立即播放。
來自 Blueprint、C++ 或從 AI 聊天機器人回應傳入的任何字串
按名稱或物件選擇 Piper 或 Kokoro 模型,並可選擇說話者與品質設定
ONNX Runtime 在本機處理文字 - 標準或串流 - 不會將任何資料傳送到外部
Float32 PCM 資料可立即用於播放、儲存、口型同步或任何後續音訊處理
兩種模型架構涵蓋廣泛的使用案例,從廣泛的語言支援到錄音室品質的輸出。
基於 ONNX 的模型涵蓋 51 種語言,包含 166 個語音模型和 2800+ 位獨特說話者。接受自訂訓練的 ONNX 模型。
151 個高品質開源語音模型,涵蓋 8 種語言:英文(美國和英國)、簡體中文、西班牙文、葡萄牙文、印地文、法文和義大利文。是現有最高品質的開源 TTS 解決方案之一。
透過外掛程式設定直接匯入您自己的 Piper (ONNX + JSON) 或 Kokoro (BIN + JSON) 語音模型,以支援特殊語音或語言。
廣泛的語言涵蓋範圍,並為 Unreal Engine 所支援的每個主要平台提供一流的支援。
除了基本合成之外,此外掛程式還提供串流輸出、多說話者選擇、可取消 的操作,以及模型管理工具 - 全部可從 Blueprints 或 C++ 存取。
兩種合成模式:在傳回音訊前先完成完整文字,或在生成時即時串流 PCM 區塊,以便立即播放長文字。
許多模型支援多個說話者 - English LibriTTS 包含 900+ 種不同的聲音。在合成時查詢每個模型的說話者數量,並依索引選擇。
隨時取消任何進行中的合成 - 對於需要在生成中途中斷並重新開始語音的響應式應用程式而言至關重要。
直接從 Unreal Editor 下載、預覽和管理語音模型。無需離開引擎即可列出可用模型、查詢中繼資料及控制儲存空間。
依名稱或物件參考擷取模型中繼資料、語言、品質等級及說話者數量。在執行階段依語言或其他條件動態選擇模型。
無需網際網路連線、不需要 API 金鑰、資料不會離開裝置。適合重視隱私的應用程式、網路隔離環境和離線遊戲。
Blueprint 範例 - 即時播放的串流 TTS

有一個 Windows 示範版可用來親身體驗外掛程式的語音品質。該示範版 包含精心挑選的 Piper 與 Kokoro 語音模型,展示不同的語言、 說話者數量與合成模式。
標準、多說話者與 Kokoro 錄音室品質模型
使用自訂文字輸入並排比較兩種合成模式
示範專案中包含完整的 Blueprint 實作供參考
影片教學
Runtime Text To Speech 是 Georgy Dev 外掛程式套件的語音輸出層,負責驅動口型同步、為 AI 角色管線提供動力,並完成語音辨識迴圈。
完整的文件涵蓋所有合成模式、模型管理、多說話者 設定、串流工作流程與平台專屬指引。
所有功能的逐步指南,包含 Blueprint 和 C++ 範例
活躍的 Discord 社群,提供開發者支援
量身打造的整合或功能開發 - [email protected]
示範 - 在編輯器中下載與預覽語音模型

在 Fab 上適用於 UE 4.27 – 5.8。包含所有語音模型、完整文件,以及一個展示串流式 TTS 與 Kokoro 語音的示範專案。