面向动态音频处理的全面解决方案——从加载文件和流式传输实时数据,到 麦克风捕获、语音活动检测和回声消除——全程无需离开 Unreal Engine。
在运行时从文件或内存缓冲区加载音频。可导出为多种格式,并支持采样率和声道控制。
动态音频缓冲区管理,支持从任何来源持续流式传输数据,包括网络音频和 TTS。
实时音频捕获,具有自动平台权限、语音活动检测和语音边界事件。
动态转换音频格式,完全控制质量、采样率和声道数。
Runtime Audio Importer 与 Unreal Engine 的原生音频系统无缝集成 - 导入的声波 在所有受支持的平台上与内置声波的行为完全一致。
文件路径、URL、内存缓冲区、麦克风或任何 PCM 提供程序
设备端解码,可选重采样、声道混合和格式转换
一个与原生兼容的 UE 声波,可随时用于任何标准播放工作流。
完整的播放控制,支持时间跟踪、PCM 回调和完成事件。
四种不同的声波类型,覆盖所有运行时音频用例。
从文件或内存缓冲区运行时导入的音频,具有完整的播放控制。支持 MP3、WAV、FLAC、OGG、BINK 和 RAW PCM。
用于连续音频流的动态缓冲区管理 - 适用于 TTS 输出、网络音频或任何增量 PCM 源。
实时麦克风捕获,具有自动平台权限、语音活动检测、语音开始/结束事件和声学回声消除。
直接从 Pixel Streaming 客户端的麦克风捕获音频。支持 Pixel Streaming 和 Pixel Streaming 2 架构,包括多人游戏场景。
广泛的格式覆盖,并为 Unreal Engine 所支持的每个主要平台提供一流支持。
除了导入之外,该插件还提供全面的播放管理、实时 PCM 访问、 元数据检查以及高级音频处理——所有这些都可以通过 Blueprints 或 C++ 实现。
播放、暂停、停止和快退,并带有精确的时间跟踪。监控播放位置和百分比,绑定完成事件,并可手动管理音频内存。
通过回调在音频播放时访问原始 32 位浮点 PCM 数据。适用于音频可视化器、频率分析器和自定义 DSP 效果。
无需完全导入即可检查音频文件 - 获取时长、采样率、声道数和格式,无需完整解码的开销。
在运行时调整音量、音高、循环和虚拟化模式。重采样和混合声道,设置初始所需采样率和声道数。
精确的语音边界检测,可配置静音持续时间和最小语音阈值。绑定语音开始和结束事件。
由 WebRTC AEC3 驱动的回声消除,适用于流式播放和可捕获的声波。绑定任何渲染声波作为参考信号,以在无扬声器漏音的情况下进行干净的人声捕捉。
蓝图示例 - 在运行时导入并播放音频

Runtime Audio Importer 是 Georgy Dev 插件套件的音频核心 - 为口型同步、语音识别、TTS 和 AI 角色管线提供支持。
通过多种提供商(OpenAI、Claude、DeepSeek、Gemini、Grok、Ollama、ElevenLabs、Google Cloud 和 Azure)实现云端 AI 聊天和 TTS。
了解更多完整的文档涵盖所有声波类型、导入工作流程、麦克风采集、PCM 数据处理以及特定于平台的指南。
所有功能的分步指南,包含 Blueprint 和 C++ 示例
活跃的 Discord 社区,提供开发者支持
定制集成或功能开发 - [email protected]
Blueprint 示例 - 麦克风捕获

可在 Fab 上获取,适用于 UE 4.24 – 5.8。包含完整文档、Blueprint 示例,并可访问更广泛的插件生态系统。