Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

Липсинк в реальном времени, офлайн и с кроссплатформенной поддержкой для MetaHuman и пользовательских персонажей. Универсальная языковая поддержка — работает с любым разговорным языком на любой платформе. Подходит для игр, интерактивных киосков, виртуального продакшена, цифровых ассистентов, тренировочных симуляций и многого другого.

UE 5.0 – 5.8
Blueprints и C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman и пользовательские персонажи

Выберите свою модель

Выберите модель, которая соответствует требованиям вашего проекта — от широкой совместимости с платформами до кинематографической анимации лица с эмоциональной выразительностью.

Standard

Универсальная совместимость

Оптимизировано для работы в реальном времени на всех поддерживаемых платформах. Работает с MetaHumans и любыми персонажами с морф-таргетами.

Предпросмотр модели Standard
  • 14 висем с гибким сопоставлением
  • Работает со всеми системами персонажей
  • Детекция смеха
  • Windows, Android, Quest
Realistic

Улучшенная визуальная точность

81 элемент управления лицом для естественного, высококачественного движения рта, для персонажей MetaHuman и совместимых с ARKit. Доступна в двух вариантах: стандартный Realistic и Mood-Enabled для эмоциональной выразительности.

Предпросмотр модели Realistic
  • 81 лицевой контрол
  • MetaHuman & ARKit-совместимые персонажи
  • Полное лицо или только рот режимы
  • Все платформы, включая Mac и iOS

Вариант с поддержкой настроения

  • 12 типов настроения с настраиваемой интенсивностью
  • Счастливый, Грустный, Злой, Уверенный, Взволнованный и другие

Как это работает

Плагин анализирует фонемы исходного аудио напрямую - транскрипция текста не требуется - что делает его полностью независимым от языка и подходящим для любого разговорного языка.

1

Аудиовход

Микрофон, TTS или аудиофайлы - любой источник аудиоданных

2

Анализ фонем

Не зависящая от языка обработка аудио на устройстве

3

Данные анимации

Виземы или элементы управления лицом, генерируемые с необязательным контекстом настроения

4

Воспроизведение в реальном времени

Применяется к персонажу с плавными переходами смешивания

Источники аудио

Поддерживается любой источник аудио, предоставляющий данные PCM.

Вход с микрофона

Синхронизация губ в реальном времени с живого захвата с микрофона с использованием захватываемой звуковой волны Runtime Audio Importer.

Синтез речи

Совместим с локальным офлайн-TTS и внешними сервисами, включая ElevenLabs, OpenAI, Azure, Google Cloud и другие.

Аудиофайлы и потоки

Обрабатывайте предварительно записанные аудиофайлы, потоковые источники или любого пользовательского поставщика PCM.

Поддержка персонажей

Несмотря на название, плагин отлично работает и с другими персонажами, помимо MetaHumans.

Unreal MetaHuman

Все три модели поддерживают MetaHumans, с прямым выводом управления лицевой анимацией для реалистичного варианта и варианта с поддержкой настроения.

Коммерческие системы персонажей

Модель Standard поддерживает Daz Genesis 8/9, Reallusion CC3/CC4, Mixamo, ReadyPlayerMe и другие через гибкое сопоставление визем. Realistic и Mood-Enabled также поддерживают их через ARKit, например, CC3/CC4, конвертированные в ARKit при экспорте.

Пользовательские персонажи

Любой персонаж с морф-таргетами может быть настроен. Поддерживаются системы фонем FACS, Apple ARKit, Preston Blair и 3ds Max.

Модель Standard - примеры пользовательских персонажей

Пример пользовательского персонажа
Пример пользовательского персонажа

Универсальная поддержка языков

Плагин обрабатывает фонемы сырого аудио напрямую, а не полагается на текстовую транскрипцию, что делает его по сути независимым от языка.

английский, испанский, французский, немецкий, японский, китайский, корейский, русский, арабский, хинди, португальский - и любой другой разговорный язык.

английский
испанский
французский
немецкий
японский
китайский
корейский
+ Любой

Справочник по платформам и моделям

Краткий справочник по поддержке платформ и возможностям моделей.

Возможность Standard Realistic Mood-Enabled
Анимационные контролы 14 визем 81 контрол 81 + 12 эмоций
MetaHuman
Пользовательские персонажи Через ARKit Через ARKit
Определение смеха
Windows
Mac / Linux / iOS
Android / Quest

Видео

Демо, обучающие материалы и пошаговые руководства, охватывающие все модели, источники звука и рабочие процессы интеграции. Весь контент совместим с Unreal Engine 5.0–5.8.

Демо AI-преобразования речи в речь

Полный рабочий процесс: распознавание речи, AI-чатбот, TTS и синхронизация губ в реальном времени.

Настройка пользовательского персонажа MetaHuman

Как добавить собственного персонажа MetaHuman в демонстрационный проект.

Синхронизация губ для персонажей ARKit

Полная настройка Animation Blueprint для персонажей ARKit с примерами потоковой передачи из аудиофайлов и ElevenLabs.

Моргание глаз и отслеживание взгляда

Автоматическое моргание и динамический взгляд, следящий за камерой игрока или любой движущейся целью, настраивается в Face Animation Blueprint.

Интерактивный AI-аватар для разговора в реальном времени

Голос, синхронизация губ и мимика работают в реальном времени в Unreal Engine 5.

Демо реалистичной модели

Демонстрация реалистичной модели с микрофоном, локальным TTS, ElevenLabs и на нескольких языках.

Синхронизация губ из аудиофайла/буфера

Настройте реалистичную синхронизацию губ, воспроизводя аудиофайл на вашем MetaHuman; также работает с аудиобуферами.

Локальный TTS с моделью, поддерживающей настроение

Офлайн-синтез речи с учётом эмоций и высококачественной синхронизацией губ, 12 настроений с регулируемой интенсивностью.

Интеграция с внешним TTS

Реалистичная модель с ElevenLabs и OpenAI для результата премиального качества.

Живой микрофон (Realistic)

Синхронизация губ в реальном времени на основе входного сигнала микрофона с использованием модели Realistic.

Живой микрофон (Standard)

Эффективная синхронизация губ в реальном времени с использованием модели Standard.

Локальный синтез речи

Полностью офлайн-синхронизация губ с локальным синтезом речи, интернет не требуется.

Экосистема плагинов

Runtime MetaHuman Lip Sync интегрируется с более широким набором плагинов Georgy Dev для создания полных конвейеров интерактивных персонажей.

Runtime Audio Importer

Импортируйте, транслируйте и захватывайте аудио во время выполнения, чтобы управлять анимациями синхронизации губ из любого источника.

Узнать больше

Runtime Speech Recognizer

Добавьте распознавание речи для интерактивных персонажей, которые реагируют на голосовые команды.

Узнать больше

Runtime Text To Speech

Офлайн-синтез речи с 2800+ голосами, полностью совместимый со всеми моделями синхронизации губ.

Узнать больше

AI Chatbot Integrator

Диалоги на основе AI с ответами на естественном языке и синхронизированной анимацией губ.

Узнать больше

Runtime Local LLM

Генерируйте диалоги с помощью локальных LLM в офлайн-режиме, затем управляйте синхронизацией губ на основе синтезированной речи для полностью офлайн-взаимодействий персонажей.

Узнать больше

Документация и поддержка

Полная документация охватывает все три модели — от начальной настройки до расширенной конфигурации персонажей, эмоциональной анимации и пользовательского сопоставления визем.

Полная документация

Пошаговые руководства для всех моделей, интеграции MetaHuman и собственных персонажей

Сообщество и поддержка

Активное Discord-сообщество с поддержкой разработчиков

Индивидуальная разработка

Индивидуальная интеграция или разработка функций - [email protected]

Готовы добавить синхронизацию губ в ваш проект?

Доступно на Fab для UE 5.0 – 5.8. Включает все три модели, полную документацию и демонстрационные проекты.