Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

Lip sync en tiempo real, sin conexión y multiplataforma para MetaHuman y personajes personalizados. Compatibilidad universal de idiomas: funciona con cualquier idioma hablado, en cualquier plataforma. Adecuado para juegos, kioscos interactivos, producción virtual, asistentes digitales, simulaciones de formación y mucho más.

UE 5.0 – 5.8
Blueprints y C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman y personajes personalizados

Elige tu modelo

Elige el modelo que se adapte a los requisitos de tu proyecto, desde una amplia compatibilidad de plataformas hasta animación facial de calidad cinematográfica con expresión emocional.

Estándar

Compatibilidad universal

Optimizado para el rendimiento en tiempo real en todas las plataformas compatibles. Funciona con MetaHumans y cualquier personaje con morph targets.

Vista previa del modelo Standard
  • 14 visemas con asignación flexible
  • Funciona con todos los sistemas de personajes
  • Detección de risas
  • Windows, Android, Quest
Realista

Fidelidad visual mejorada

81 controles faciales para un movimiento de la boca natural y de alta calidad, para MetaHuman y personajes compatibles con ARKit. Disponible en dos variantes: Realista estándar y con estados de ánimo para expresión emocional.

Vista previa del modelo Realistic
  • 81 controles faciales
  • MetaHuman y personajes compatibles con ARKit
  • Modos de rostro completo o solo boca
  • Todas las plataformas, incluidas Mac e iOS

Variante con estados de ánimo

  • 12 tipos de estado de ánimo con intensidad configurable
  • Feliz, Triste, Enojado, Confiado, Emocionado y más

Cómo funciona

El plugin analiza directamente los fonemas de audio sin procesar, sin necesidad de transcripción de texto, lo que lo hace totalmente independiente del idioma y apto para cualquier idioma hablado.

1

Entrada de audio

Micrófono, TTS o archivos de audio - cualquier fuente de datos de audio

2

Análisis de fonemas

Procesamiento de audio independiente del idioma, en el dispositivo

3

Datos de animación

Visemas o controles faciales generados con contexto de estado de ánimo opcional

4

Reproducción en tiempo real

Aplicado al personaje con transiciones de mezcla suaves

Fuentes de audio

Se admite cualquier fuente de audio que proporcione datos PCM.

Entrada de micrófono

Sincronización labial en tiempo real a partir de la captura de micrófono en vivo usando la onda de sonido capturable de Runtime Audio Importer.

Texto a voz

Compatible con TTS local sin conexión y servicios externos como ElevenLabs, OpenAI, Azure, Google Cloud y más.

Archivos y transmisiones de audio

Procesa archivos de audio pregrabados, fuentes de transmisión o cualquier proveedor de PCM personalizado.

Compatibilidad con personajes

A pesar del nombre, el plugin funciona bien más allá de MetaHumans.

Unreal MetaHuman

Los tres modelos admiten MetaHumans, con salida directa de control facial para Realista y con estados de ánimo.

Sistemas de personajes comerciales

El modelo Standard admite Daz Genesis 8/9, Reallusion CC3/CC4/CC5, Mixamo y más mediante un mapeo flexible de visemas. Realistic y Mood-Enabled también los admiten mediante ARKit, por ejemplo, CC3/CC4/CC5 convertidos a ARKit al exportar.

Personajes personalizados

Se puede configurar cualquier personaje con objetivos de morph. Compatible con FACS, Apple ARKit, Preston Blair y sistemas de fonemas de 3ds Max.

Modelo Standard: ejemplos de personajes personalizados

Ejemplo de personaje personalizado
Ejemplo de personaje personalizado

Compatibilidad universal de idiomas

El plugin procesa directamente los fonemas de audio sin procesar en lugar de depender de la transcripción de texto, lo que lo hace inherentemente independiente del idioma.

Inglés, español, francés, alemán, japonés, chino, coreano, ruso, árabe, hindi, portugués, y cualquier otro idioma hablado.

Inglés
Español
Francés
Alemán
Japonés
Chino
Coreano
+ Cualquiera

Referencia de plataformas y modelos

Referencia rápida sobre la compatibilidad de plataformas y las capacidades de los modelos.

Capacidad Standard Realistic Mood-Enabled
Controles de animación 14 visemas 81 controles 81 + 12 estados de ánimo
MetaHuman
Personajes personalizados Mediante ARKit Mediante ARKit
Detección de risa
Windows
Mac / Linux / iOS
Android / Quest

Vídeos

Demos, tutoriales y guías paso a paso que abarcan todos los modelos, fuentes de audio y flujos de trabajo de integración. Todo el contenido es compatible con Unreal Engine 5.0 hasta 5.8.

Demostración de voz a voz con AI

Flujo de trabajo completo: reconocimiento de voz, chatbot de AI, TTS y sincronización labial en tiempo real.

Configuración de personaje MetaHuman personalizado

Cómo añadir tu propio personaje MetaHuman al proyecto de demostración.

Sincronización labial para personajes ARKit

Configuración completa de Animation Blueprint para personajes ARKit, con archivo de audio y ejemplos de streaming de ElevenLabs.

Parpadeo y seguimiento de la mirada

Parpadeo automático y mirada dinámica que sigue la cámara del jugador o cualquier objetivo en movimiento, configurable en el Animation Blueprint facial.

Avatar conversacional de AI en tiempo real

Voz, sincronización labial y animación facial en vivo en Unreal Engine 5.

Demostración básica de sincronización labial

Muestra del modelo Realistic con micrófono, TTS local, ElevenLabs y varios idiomas.

Sincronización labial desde archivo/búfer de audio

Configura una sincronización labial realista reproduciendo un archivo de audio en tu MetaHuman, también funciona con búferes de audio.

Sincronización labial desde un servidor remoto

Controla la sincronización labial en tiempo real desde una fuente de audio en streaming a través de WebSocket, con el audio importado y procesado fragmento a fragmento.

TTS local con modelo de estados de ánimo

Texto a voz offline con sincronización labial de alta calidad y sensible a las emociones, 12 estados de ánimo con intensidad ajustable.

Integración con TTS externo

Modelo Realista con ElevenLabs y OpenAI para una salida de calidad premium.

Micrófono en vivo (Realista)

Sincronización labial en tiempo real desde la entrada de micrófono utilizando el modelo Realista.

Texto a voz local

Sincronización labial totalmente offline con TTS local, no se necesita internet.

Ecosistema de plugins

Runtime MetaHuman Lip Sync se integra con la amplia suite de plugins de Georgy Dev para construir pipelines completos de personajes interactivos.

Runtime Audio Importer

Importa, transmite y captura audio en tiempo de ejecución para controlar animaciones de sincronización labial desde cualquier fuente.

Más información

Runtime Speech Recognizer

Añade reconocimiento de voz para personajes interactivos que responden a comandos de voz.

Más información

Runtime Text To Speech

Síntesis de voz offline con más de 2800 voces, totalmente compatible con todos los modelos de sincronización labial.

Más información

Integrador de chatbots con IA

Conversaciones impulsadas por IA con respuestas en lenguaje natural y animación labial sincronizada.

Más información

Runtime Local LLM

Genera diálogos con LLM en el dispositivo offline, luego controla la sincronización labial a partir del habla sintetizada para interacciones de personajes totalmente offline.

Más información

Documentación y soporte

La documentación completa cubre los tres modelos: desde la configuración inicial hasta la configuración avanzada de personajes, animación emocional y mapeo de visemas personalizado.

Documentación completa

Guías paso a paso para todos los modelos, integración con MetaHuman y personajes personalizados

Comunidad y soporte

Comunidad activa en Discord con soporte para desarrolladores

Desarrollo personalizado

Integración o desarrollo de funciones a medida - [email protected]

¿Listo para añadir lip sync a tu proyecto?

Disponible en Fab para UE 5.0 – 5.8. Incluye los tres modelos, documentación completa y proyectos de demostración.