Runtime Audio Importer | Georgy Dev

Runtime Audio Importer

适用于 Unreal Engine 的高级运行时音频处理。导入、流式传输、转码和操作 音频——可在所有平台上于运行时进行,完全支持 Blueprint 和 C++。

UE 4.24 – 5.8
Blueprints & C++
支持所有平台
多种音频格式

一切音频,尽在运行时

面向动态音频处理的全面解决方案——从加载文件和流式传输实时数据,到 麦克风捕获、语音活动检测和回声消除——全程无需离开 Unreal Engine。

导入与导出

在运行时从文件或内存缓冲区加载音频。可导出为多种格式,并支持采样率和声道控制。

流式传输

动态音频缓冲区管理,支持从任何来源持续流式传输数据,包括网络音频和 TTS。

麦克风捕获

实时音频捕获,具有自动平台权限、语音活动检测和语音边界事件。

转码

动态转换音频格式,完全控制质量、采样率和声道数。

工作原理

Runtime Audio Importer 与 Unreal Engine 的原生音频系统无缝集成 - 导入的声波 在所有受支持的平台上与内置声波的行为完全一致。

1

音频源

文件路径、URL、内存缓冲区、麦克风或任何 PCM 提供程序

2

解码与处理

设备端解码,可选重采样、声道混合和格式转换

3

声波

一个与原生兼容的 UE 声波,可随时用于任何标准播放工作流。

4

播放与事件

完整的播放控制,支持时间跟踪、PCM 回调和完成事件。

声波类型

四种不同的声波类型,覆盖所有运行时音频用例。

导入的声波

从文件或内存缓冲区运行时导入的音频,具有完整的播放控制。支持 MP3、WAV、FLAC、OGG、BINK 和 RAW PCM。

流式声波

用于连续音频流的动态缓冲区管理 - 适用于 TTS 输出、网络音频或任何增量 PCM 源。

可捕获声波

实时麦克风捕获,具有自动平台权限、语音活动检测、语音开始/结束事件和声学回声消除。

Pixel Streaming 可捕获声波

直接从 Pixel Streaming 客户端的麦克风捕获音频。支持 Pixel Streaming 和 Pixel Streaming 2 架构,包括多人游戏场景。

支持的格式与平台

广泛的格式覆盖,并为 Unreal Engine 所支持的每个主要平台提供一流支持。

音频格式

MP3
WAV
FLAC
OGG Vorbis
OGG Opus
BINK
RAW PCM - Int8, UInt8, Int16, UInt16, Int32, UInt32, Float32

平台支持

Windows
Mac
Linux
Android
iOS
Meta Quest
PlayStation
Xbox
Nintendo Switch

全功能音频控制

除了导入之外,该插件还提供全面的播放管理、实时 PCM 访问、 元数据检查以及高级音频处理——所有这些都可以通过 Blueprints 或 C++ 实现。

播放控制

播放、暂停、停止和快退,并带有精确的时间跟踪。监控播放位置和百分比,绑定完成事件,并可手动管理音频内存。

实时 PCM 数据

通过回调在音频播放时访问原始 32 位浮点 PCM 数据。适用于音频可视化器、频率分析器和自定义 DSP 效果。

元数据与文件头信息

无需完全导入即可检查音频文件 - 获取时长、采样率、声道数和格式,无需完整解码的开销。

音频操作

在运行时调整音量、音高、循环和虚拟化模式。重采样和混合声道,设置初始所需采样率和声道数。

语音活动检测

精确的语音边界检测,可配置静音持续时间和最小语音阈值。绑定语音开始和结束事件。

声学回声消除

由 WebRTC AEC3 驱动的回声消除,适用于流式播放和可捕获的声波。绑定任何渲染声波作为参考信号,以在无扬声器漏音的情况下进行干净的人声捕捉。

蓝图示例 - 在运行时导入并播放音频

在运行时导入音频的 Blueprint 示例

插件生态系统

Runtime Audio Importer 是 Georgy Dev 插件套件的音频核心 - 为口型同步、语音识别、TTS 和 AI 角色管线提供支持。

Runtime MetaHuman Lip Sync

为 MetaHuman 和自定义角色提供实时口型同步,由该插件提供的任何音频源驱动。

了解更多

Runtime Speech Recognizer

由 Whisper 驱动的离线语音转文字,支持 95 种以上语言的转录和翻译。

了解更多

Runtime Text To Speech

完全离线的语音合成,拥有 51 种语言、2800 多种声音 - 无需互联网连接。

了解更多

AI Chatbot Integrator

通过多种提供商(OpenAI、Claude、DeepSeek、Gemini、Grok、Ollama、ElevenLabs、Google Cloud 和 Azure)实现云端 AI 聊天和 TTS。

了解更多

Runtime Local LLM

使用设备端 LLM 离线生成对话,然后驱动口型同步 从 合成语音实现完全离线的角色交互。

了解更多

文档与支持

完整的文档涵盖所有声波类型、导入工作流程、麦克风采集、PCM 数据处理以及特定于平台的指南。

完整文档

所有功能的分步指南,包含 Blueprint 和 C++ 示例

社区与支持

活跃的 Discord 社区,提供开发者支持

定制开发

定制集成或功能开发 - [email protected]

Blueprint 示例 - 麦克风捕获

麦克风捕获 Blueprint 示例

准备好将运行时音频添加到您的项目了吗?

可在 Fab 上获取,适用于 UE 4.24 – 5.8。包含完整文档、Blueprint 示例,并可访问更广泛的插件生态系统。