Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

Lip sync thời gian thực, ngoại tuyến và đa nền tảng cho MetaHuman và các nhân vật tùy chỉnh. Hỗ trợ mọi ngôn ngữ - hoạt động với bất kỳ ngôn ngữ nói nào, trên mọi nền tảng. Phù hợp cho game, kiosk tương tác, sản xuất ảo, trợ lý kỹ thuật số, mô phỏng đào tạo và hơn thế nữa.

UE 5.0 – 5.8
Blueprints & C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman & nhân vật tùy chỉnh

Chọn model của bạn

Chọn model phù hợp với yêu cầu dự án của bạn - từ khả năng tương thích nền tảng rộng rãi đến hoạt họa khuôn mặt chất lượng điện ảnh với biểu cảm cảm xúc.

Tiêu chuẩn

Tương thích toàn diện

Được tối ưu cho hiệu năng thời gian thực trên tất cả nền tảng được hỗ trợ. Hoạt động với MetaHuman và mọi nhân vật có morph target.

Xem trước mô hình Tiêu chuẩn
  • 14 viseme với ánh xạ linh hoạt
  • Hoạt động với mọi hệ thống nhân vật
  • Phát hiện tiếng cười
  • Windows, Android, Quest
Chân thực

Độ trung thực hình ảnh nâng cao

81 điều khiển khuôn mặt cho chuyển động miệng tự nhiên, chất lượng cao, dành cho MetaHuman và các nhân vật tương thích ARKit. Có sẵn ở hai biến thể: Realistic tiêu chuẩn và Mood-Enabled cho biểu cảm cảm xúc.

Xem trước mô hình Chân thực
  • 81 điều khiển khuôn mặt
  • MetaHuman & nhân vật tương thích ARKit
  • Chế độ Toàn khuôn mặt hoặc Chỉ miệng
  • Tất cả nền tảng bao gồm Mac & iOS

Biến thể Hỗ trợ cảm xúc

  • 12 loại cảm xúc với cường độ có thể cấu hình
  • Vui vẻ, Buồn, Giận dữ, Tự tin, Phấn khích & nhiều hơn nữa

Cách hoạt động

Plugin phân tích trực tiếp các âm vị từ âm thanh thô - không cần chuyển đổi văn bản - khiến nó hoàn toàn độc lập với ngôn ngữ và phù hợp với mọi ngôn ngữ nói.

1

Đầu vào âm thanh

Micrô, TTS hoặc tệp âm thanh - bất kỳ nguồn dữ liệu âm thanh nào

2

Phân tích âm vị

Xử lý âm thanh độc lập với ngôn ngữ, trên thiết bị

3

Dữ liệu hoạt ảnh

Khẩu hình hoặc điều khiển khuôn mặt được tạo với ngữ cảnh cảm xúc tùy chọn

4

Phát lại thời gian thực

Áp dụng cho nhân vật với các chuyển tiếp hòa trộn mượt mà

Nguồn âm thanh

Hỗ trợ mọi nguồn âm thanh cung cấp dữ liệu PCM.

Đầu vào micrô

Đồng bộ khẩu hình thời gian thực từ việc thu micrô trực tiếp bằng sóng âm thanh có thể thu của Runtime Audio Importer.

Chuyển văn bản thành giọng nói

Tương thích với TTS ngoại tuyến cục bộ và các dịch vụ bên ngoài bao gồm ElevenLabs, OpenAI, Azure, Google Cloud, và nhiều hơn nữa.

Tệp & Luồng âm thanh

Xử lý tệp âm thanh ghi sẵn, nguồn phát trực tuyến hoặc bất kỳ nhà cung cấp PCM tùy chỉnh nào.

Hỗ trợ nhân vật

Dù có tên như vậy, plugin hoạt động tốt vượt xa MetaHuman.

Unreal MetaHuman

Cả ba mô hình đều hỗ trợ MetaHuman, với đầu ra điều khiển khuôn mặt trực tiếp cho Chân thực và Hỗ trợ cảm xúc.

Hệ thống nhân vật thương mại

Mô hình Tiêu chuẩn hỗ trợ Daz Genesis 8/9, Reallusion CC3/CC4/CC5, Mixamo, và nhiều hơn nữa thông qua ánh xạ khẩu hình linh hoạt. Chân thực và Hỗ trợ tâm trạng cũng hỗ trợ những mô hình này thông qua ARKit, ví dụ CC3/CC4/CC5 được chuyển đổi sang ARKit khi xuất.

Nhân vật tùy chỉnh

Bất kỳ nhân vật nào có mục tiêu biến dạng đều có thể được cấu hình. Hỗ trợ FACS, Apple ARKit, Preston Blair và hệ thống âm vị 3ds Max.

Mô hình Tiêu chuẩn - Ví dụ nhân vật tùy chỉnh

Ví dụ nhân vật tùy chỉnh
Ví dụ nhân vật tùy chỉnh

Hỗ trợ ngôn ngữ phổ quát

Plugin xử lý trực tiếp các âm vị âm thanh thô thay vì dựa vào phiên âm văn bản, khiến nó vốn không phụ thuộc vào ngôn ngữ.

Tiếng Anh, Tiếng Tây Ban Nha, Tiếng Pháp, Tiếng Đức, Tiếng Nhật, Tiếng Trung, Tiếng Hàn, Tiếng Nga, Tiếng Ả Rập, Tiếng Hindi, Tiếng Bồ Đào Nha - và bất kỳ ngôn ngữ nói nào khác.

Tiếng Anh
Tiếng Tây Ban Nha
Tiếng Pháp
Tiếng Đức
Tiếng Nhật
Tiếng Trung
Tiếng Hàn
+ Bất kỳ

Tham chiếu nền tảng & mô hình

Tham chiếu nhanh cho hỗ trợ nền tảng và khả năng của mô hình.

Khả năng Tiêu chuẩn Chân thực Hỗ trợ tâm trạng
Điều khiển hoạt ảnh 14 khẩu hình 81 điều khiển 81 + 12 tâm trạng
MetaHuman
Nhân vật tùy chỉnh Thông qua ARKit Thông qua ARKit
Phát hiện tiếng cười
Windows
Mac / Linux / iOS
Android / Quest

Video

Bản demo, hướng dẫn và hướng dẫn từng bước bao gồm tất cả model, nguồn âm thanh và quy trình tích hợp. Tất cả nội dung đều tương thích với Unreal Engine 5.0 đến 5.8.

Bản demo AI Speech-to-Speech

Quy trình đầy đủ: nhận dạng giọng nói, chatbot AI, TTS và đồng bộ khẩu hình thời gian thực.

Thiết lập nhân vật MetaHuman tùy chỉnh

Cách thêm nhân vật MetaHuman của riêng bạn vào dự án demo.

Đồng bộ khẩu hình cho nhân vật ARKit

Thiết lập Animation Blueprint đầy đủ cho nhân vật ARKit, với ví dụ về tệp âm thanh và truyền phát ElevenLabs.

Chớp mắt & Theo dõi ánh nhìn

Chớp mắt tự động và ánh nhìn động theo camera của người chơi hoặc bất kỳ mục tiêu di chuyển nào, có thể cấu hình trong Face Animation Blueprint.

Avatar AI hội thoại thời gian thực

Giọng nói, đồng bộ khẩu hình và hoạt ảnh khuôn mặt chạy trực tiếp trong Unreal Engine 5.

Bản demo đồng bộ khẩu hình cơ bản

Trình diễn model Realistic qua micrô, TTS cục bộ, ElevenLabs và nhiều ngôn ngữ.

Đồng bộ khẩu hình từ tệp/bộ đệm âm thanh

Thiết lập đồng bộ khẩu hình chân thực bằng cách phát tệp âm thanh trên MetaHuman của bạn, cũng hoạt động với bộ đệm âm thanh.

Đồng bộ khớp môi từ máy chủ từ xa

Điều khiển đồng bộ khớp môi thời gian thực từ nguồn âm thanh phát trực tuyến qua WebSocket, với âm thanh được nhập và xử lý từng đoạn một.

TTS cục bộ với mô hình hỗ trợ tâm trạng

Chuyển văn bản thành giọng nói ngoại tuyến với đồng bộ khớp môi chất lượng cao nhận biết cảm xúc, 12 tâm trạng với cường độ điều chỉnh được.

Tích hợp TTS bên ngoài

Mô hình Realistic với ElevenLabs & OpenAI cho đầu ra chất lượng cao cấp.

Micrô trực tiếp (Realistic)

Đồng bộ khớp môi thời gian thực từ đầu vào micrô sử dụng mô hình Realistic.

Chuyển văn bản thành giọng nói cục bộ

Đồng bộ khớp môi hoàn toàn ngoại tuyến với TTS cục bộ, không cần internet.

Hệ sinh thái plugin

Runtime MetaHuman Lip Sync tích hợp với bộ plugin Georgy Dev rộng lớn hơn để xây dựng các pipeline nhân vật tương tác hoàn chỉnh.

Runtime Audio Importer

Nhập, phát trực tuyến và ghi âm thanh trong thời gian chạy để điều khiển hoạt ảnh đồng bộ khớp môi từ bất kỳ nguồn nào.

Tìm hiểu thêm

Runtime Speech Recognizer

Thêm nhận dạng giọng nói cho các nhân vật tương tác có thể phản hồi với lệnh thoại.

Tìm hiểu thêm

Runtime Text To Speech

Tổng hợp giọng nói ngoại tuyến với hơn 2800 giọng, hoàn toàn tương thích với tất cả mô hình đồng bộ khớp môi.

Tìm hiểu thêm

AI Chatbot Integrator

Các cuộc trò chuyện do AI điều khiển với phản hồi ngôn ngữ tự nhiên và hoạt ảnh đồng bộ khớp môi.

Tìm hiểu thêm

Runtime Local LLM

Tạo hội thoại với các LLM trên thiết bị ngoại tuyến, sau đó điều khiển đồng bộ khớp môi từ giọng nói được tổng hợp để có các tương tác nhân vật hoàn toàn ngoại tuyến.

Tìm hiểu thêm

Tài liệu & Hỗ trợ

Tài liệu toàn diện bao gồm cả ba mô hình - từ thiết lập ban đầu đến cấu hình nhân vật nâng cao, hoạt ảnh cảm xúc và ánh xạ viseme tùy chỉnh.

Tài liệu đầy đủ

Hướng dẫn từng bước cho tất cả các model, tích hợp MetaHuman và nhân vật tùy chỉnh

Cộng đồng & Hỗ trợ

Cộng đồng Discord sôi động với sự hỗ trợ từ nhà phát triển

Phát triển tùy chỉnh

Tích hợp hoặc phát triển tính năng theo yêu cầu - [email protected]

Sẵn sàng thêm Đồng bộ khẩu hình vào dự án của bạn?

Có sẵn trên Fab cho UE 5.0 – 5.8. Bao gồm cả ba model, tài liệu đầy đủ và các dự án demo.