
Xử lý âm thanh thời gian chạy nâng cao cho Unreal Engine. Nhập, truyền phát, chuyển mã và thao tác âm thanh trong thời gian chạy trên tất cả các nền tảng - với hỗ trợ đầy đủ Blueprint và C++.
Một giải pháp toàn diện cho xử lý âm thanh động - từ tải tệp và truyền phát dữ liệu trực tiếp, đến thu âm từ micro, phát hiện hoạt động giọng nói và khử tiếng vang âm thanh - tất cả mà không cần rời khỏi Unreal Engine.
Tải âm thanh từ tệp hoặc bộ đệm bộ nhớ trong thời gian chạy. Xuất sang nhiều định dạng với kiểm soát tốc độ lấy mẫu và kênh.
Quản lý bộ đệm âm thanh động để truyền phát dữ liệu liên tục từ mọi nguồn, bao gồm âm thanh mạng và TTS.
Thu âm thanh theo thời gian thực với cấp quyền nền tảng tự động, phát hiện hoạt động giọng nói và sự kiện ranh giới lời nói.
Chuyển đổi giữa các định dạng âm thanh một cách linh hoạt với toàn quyền kiểm soát chất lượng, tần số lấy mẫu và số kênh.
Runtime Audio Importer tích hợp liền mạch với hệ thống âm thanh gốc của Unreal Engine - các sóng âm thanh được nhập hoạt động giống hệt các sóng âm thanh có sẵn trên tất cả các nền tảng được hỗ trợ.
Đường dẫn tệp, URL, bộ đệm bộ nhớ, micrô hoặc bất kỳ nhà cung cấp PCM nào
Giải mã trên thiết bị với tùy chọn lấy mẫu lại, trộn kênh và chuyển đổi định dạng
Một sóng âm thanh UE tương thích với hệ thống gốc, sẵn sàng cho mọi quy trình phát lại tiêu chuẩn
Toàn quyền kiểm soát phát lại với theo dõi thời gian, hàm gọi lại PCM và sự kiện hoàn tất
Bốn loại sóng âm thanh riêng biệt để đáp ứng mọi trường hợp sử dụng âm thanh trong thời gian chạy.
Âm thanh được nhập trong thời gian chạy từ tệp hoặc bộ đệm bộ nhớ, với toàn quyền kiểm soát phát lại. Hỗ trợ MP3, WAV, FLAC, OGG, BINK và RAW PCM.
Quản lý bộ đệm động cho các luồng âm thanh liên tục - phù hợp cho đầu ra TTS, âm thanh mạng hoặc bất kỳ nguồn PCM tăng dần nào.
Thu micrô theo thời gian thực với cấp quyền nền tảng tự động, phát hiện hoạt động giọng nói, sự kiện bắt đầu/kết thúc lời nói và khử tiếng vang âm thanh.
Thu âm thanh trực tiếp từ micrô của máy khách Pixel Streaming. Hỗ trợ cả kiến trúc Pixel Streaming và Pixel Streaming 2, bao gồm các tình huống nhiều người chơi.
Bao phủ định dạng rộng rãi và hỗ trợ hạng nhất cho mọi nền tảng chính mà Unreal Engine hướng tới.
Ngoài việc nhập tệp, plugin cung cấp khả năng quản lý phát lại toàn diện, truy cập PCM theo thời gian thực, kiểm tra siêu dữ liệu và thao tác âm thanh nâng cao - tất cả đều từ Blueprints hoặc C++.
Phát, tạm dừng, dừng và tua lại với theo dõi thời gian chính xác. Theo dõi vị trí và tỷ lệ phần trăm phát lại, liên kết với các sự kiện hoàn thành và quản lý bộ nhớ âm thanh thủ công.
Truy cập dữ liệu PCM dấu phẩy động 32 bit thô khi âm thanh phát thông qua các callback. Phù hợp cho trình trực quan hóa âm thanh, bộ phân tích tần số và hiệu ứng DSP tùy chỉnh.
Kiểm tra tệp âm thanh mà không cần nhập hoàn toàn - lấy thời lượng, tần số lấy mẫu, số kênh và định dạng mà không phải tốn chi phí giải mã toàn bộ.
Điều chỉnh âm lượng, cao độ, vòng lặp và chế độ ảo hóa trong thời gian chạy. Lấy mẫu lại và trộn kênh, đặt tần số lấy mẫu và số kênh mong muốn ban đầu.
Phát hiện ranh giới lời nói chính xác với thời lượng im lặng và ngưỡng lời nói tối thiểu có thể cấu hình. Liên kết với các sự kiện bắt đầu và kết thúc lời nói.
Khử tiếng vọng sử dụng WebRTC AEC3 cho các sóng âm thanh phát trực tiếp và có thể thu âm. Liên kết mọi sóng âm thanh kết xuất làm tín hiệu tham chiếu để thu giọng nói sạch mà không bị lọt loa.
Ví dụ Blueprint - Nhập và phát âm thanh trong thời gian chạy

Runtime Audio Importer là xương sống âm thanh của bộ plugin Georgy Dev - cung cấp sức mạnh cho khớp môi, nhận dạng giọng nói, TTS và các pipeline nhân vật AI.
Khớp môi thời gian thực cho MetaHuman và các nhân vật tùy chỉnh, được điều khiển bởi bất kỳ nguồn âm thanh nào mà plugin này cung cấp.
Tìm hiểu thêmChuyển giọng nói thành văn bản ngoại tuyến được hỗ trợ bởi Whisper, hỗ trợ phiên âm và dịch thuật trên 95+ ngôn ngữ.
Tìm hiểu thêmTổng hợp giọng nói hoàn toàn ngoại tuyến với 2800+ giọng nói trên 51 ngôn ngữ - không cần kết nối internet.
Tìm hiểu thêmTrò chuyện AI đám mây và TTS qua nhiều nhà cung cấp (OpenAI, Claude, DeepSeek, Gemini, Grok, Ollama, ElevenLabs, Google Cloud và Azure).
Tìm hiểu thêmTạo hội thoại ngoại tuyến với LLM trên thiết bị, sau đó điều khiển khớp môi từ giọng nói tổng hợp để có tương tác nhân vật hoàn toàn ngoại tuyến.
Tìm hiểu thêmTài liệu toàn diện bao gồm tất cả các loại sóng âm thanh, quy trình nhập, thu âm micro, xử lý dữ liệu PCM và hướng dẫn riêng cho từng nền tảng.
Hướng dẫn từng bước cho tất cả tính năng, kèm ví dụ về Blueprint và C++
Cộng đồng Discord năng động với sự hỗ trợ từ các nhà phát triển
Tích hợp hoặc phát triển tính năng theo yêu cầu - [email protected]
Ví dụ Blueprint - Thu âm micro

Có sẵn trên Fab cho UE 4.24 – 5.8. Bao gồm tài liệu đầy đủ, ví dụ Blueprint và quyền truy cập vào hệ sinh thái plugin rộng lớn hơn.