Runtime Audio Importer | Georgy Dev

Runtime Audio Importer

專為 Unreal Engine 設計的高階執行期音訊處理。可在執行期於所有平台匯入、串流、轉碼及操控音訊 - 完整支援 Blueprint 與 C++。

UE 4.24 – 5.8
Blueprints 與 C++
支援所有平台
多種音訊格式

一切音訊,在執行期

一個全面的動態音訊處理解決方案 - 從載入檔案與串流即時資料,到麥克風擷取、語音活動偵測與聲學迴音消除 - 全程無需離開 Unreal Engine。

匯入與匯出

在執行期從檔案或記憶體緩衝區載入音訊。可匯出為多種格式,並控制取樣率與聲道。

串流

動態音訊緩衝區管理,可從任何來源連續串流資料,包括網路音訊與 TTS。

麥克風擷取

即時音訊擷取,具備自動平台權限、語音活動偵測,以及語音邊界事件。

轉碼

動態轉換音訊格式,並完整控制品質、取樣率與聲道數。

運作方式

Runtime Audio Importer 與 Unreal Engine 的原生音訊系統無縫整合——匯入的聲波 在所有支援平台上,行為與內建聲波完全一致。

1

音訊來源

檔案路徑、URL、記憶體緩衝區、麥克風,或任何 PCM 提供者

2

解碼與處理

裝置端解碼,可選擇重新取樣、聲道混音與格式轉換

3

聲波

與 UE 原生相容的聲波,可隨時用於任何標準播放工作流程

4

播放與事件

完整的播放控制,具備時間追蹤、PCM 回呼與完成事件

聲波類型

四種不同的聲波類型,涵蓋所有執行時期音訊使用情境。

已匯入聲波

從檔案或記憶體緩衝區在執行時期匯入的音訊,具備完整的播放控制。支援 MP3、WAV、FLAC、OGG、BINK 與 RAW PCM。

串流聲波

針對連續音訊串流的動態緩衝區管理——適用於 TTS 輸出、網路音訊,或任何增量 PCM 來源。

可擷取聲波

即時麥克風擷取,具備自動平台權限、語音活動偵測、語音開始/結束事件,以及聲學回聲消除。

Pixel Streaming 可擷取聲波

直接從 Pixel Streaming 用戶端的麥克風擷取音訊。同時支援 Pixel Streaming 與 Pixel Streaming 2 架構,包括多人情境。

支援的格式與平台

廣泛的格式涵蓋範圍,以及對 Unreal Engine 每個主要目標平台的一流支援。

音訊格式

MP3
WAV
FLAC
OGG Vorbis
OGG Opus
BINK
RAW PCM - Int8, UInt8, Int16, UInt16, Int32, UInt32, Float32

平台支援

Windows
Mac
Linux
Android
iOS
Meta Quest
PlayStation
Xbox
Nintendo Switch

功能齊全的音訊控制

除了匯入之外,此外掛程式還提供了全面的播放管理、即時 PCM 存取、 中繼資料檢視,以及進階音訊處理 - 全部可透過 Blueprints 或 C++ 完成。

播放控制

具備精確的時間追蹤,可播放、暫停、停止和倒轉。監控播放位置與百分比,綁定完成事件,並可手動管理音訊記憶體。

即時 PCM 資料

在音訊播放期間,透過回呼存取原始 32 位元浮點 PCM 資料。適用於音訊視覺化工具、頻率分析器和自訂 DSP 效果。

中繼資料與檔頭資訊

檢查音訊檔案而無需完整匯入 - 取得持續時間、取樣率、聲道數與格式,不需耗費完整解碼的資源。

音訊操控

在執行時期調整音量、音高、循環播放與虛擬化模式。重新取樣與混合聲道,設定初始所需的取樣率與聲道數。

語音活動偵測

透過可設定的靜音持續時間與最低語音門檻,進行精確的語音邊界偵測。可綁定至語音開始與結束事件。

聲學迴聲消除

WebRTC AEC3 驅動的迴聲消除,適用於串流與可捕捉的音波。將任何渲染音波綁定為參考訊號,以達成乾淨的語音捕捉,避免揚聲器漏音。

Blueprint 範例 - 在執行時期匯入並播放音訊

在執行期匯入音訊的 Blueprint 範例

外掛程式生態系

Runtime Audio Importer 是 Georgy Dev 外掛程式套件的音訊骨幹 - 驅動口型同步、語音辨識、TTS 與 AI 角色管線。

Runtime MetaHuman Lip Sync

由此外掛程式提供的任何音訊來源驅動,為 MetaHuman 與自訂角色帶來即時口型同步。

了解更多

Runtime Speech Recognizer

由 Whisper 驅動的離線語音轉文字,支援 95 種以上語言的轉錄與翻譯。

了解更多

Runtime Text To Speech

完全離線的語音合成,涵蓋 51 種語言、2800 種以上語音 - 無需網際網路連線。

了解更多

AI Chatbot Integrator

雲端 AI 聊天與 TTS,可透過各種提供者(OpenAI、Claude、DeepSeek、Gemini、Grok、Ollama、ElevenLabs、Google Cloud 與 Azure)。

了解更多

Runtime Local LLM

於離線狀態下使用裝置端 LLM 生成對話,然後驅動口型同步 從 合成的語音,以實現完全離線的角色互動。

了解更多

文件與支援

全面的文件涵蓋所有音波類型、匯入工作流程、麥克風捕捉、PCM 資料處理,以及平台特定指南。

完整文件

所有功能的逐步指南,包含 Blueprint 與 C++ 範例

社群與支援

活躍的 Discord 社群,提供開發者支援

自訂開發

量身打造整合或功能開發 - [email protected]

Blueprint 範例 - 麥克風擷取

麥克風擷取 Blueprint 範例

準備好將 Runtime Audio 加入您的專案了嗎?

可在 Fab 上取得,適用於 UE 4.24 – 5.8。包含完整文件、Blueprint 範例,以及更廣泛外掛生態系統的存取權限。