Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

Sincronização labial em tempo real, offline e multiplataforma para MetaHuman e personagens personalizados. Suporte universal a idiomas - funciona com qualquer idioma falado, em qualquer plataforma. Adequado para jogos, quiosques interativos, produção virtual, assistentes digitais, simulações de treinamento e muito mais.

UE 5.0 – 5.8
Blueprints e C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman e personagens personalizados

Escolha seu modelo

Escolha o modelo que atende aos requisitos do seu projeto - desde ampla compatibilidade de plataformas até animação facial de qualidade cinematográfica com expressão emocional.

Padrão

Compatibilidade Universal

Otimizado para desempenho em tempo real em todas as plataformas suportadas. Funciona com MetaHumans e qualquer personagem com morph targets.

Pré-visualização do modelo Standard
  • 14 visemas com mapeamento flexível
  • Funciona com todos os sistemas de personagens
  • Detecção de riso
  • Windows, Android, Quest
Realista

Fidelidade Visual Aprimorada

81 controles faciais para movimento natural e de alta qualidade da boca, para MetaHuman e personagens compatíveis com ARKit. Disponível em duas variantes: Realista padrão e com suporte a emoções para expressão emocional.

Pré-visualização do modelo Realistic
  • 81 controles faciais
  • MetaHuman e personagens compatíveis com ARKit
  • Modos de rosto completo ou somente boca
  • Todas as plataformas, incluindo Mac e iOS

Variante Mood-Enabled

  • 12 tipos de humor com intensidade configurável
  • Feliz, Triste, Bravo, Confiante, Animado e mais

Como Funciona

O plugin analisa fonemas de áudio bruto diretamente - sem necessidade de transcrição de texto - tornando-o totalmente independente de idioma e adequado para qualquer idioma falado.

1

Entrada de Áudio

Microfone, TTS ou arquivos de áudio - qualquer fonte de dados de áudio

2

Análise de Fonemas

Processamento de áudio independente de idioma, no dispositivo

3

Dados de Animação

Visemas ou controles faciais gerados com contexto de humor opcional

4

Reprodução em Tempo Real

Aplicado ao personagem com transições suaves de mistura

Fontes de Áudio

Qualquer fonte de áudio que forneça dados PCM é suportada.

Entrada de Microfone

Sincronização labial em tempo real a partir da captura de microfone ao vivo usando a onda sonora capturável do Runtime Audio Importer.

Texto para Fala

Compatível com TTS offline local e serviços externos, incluindo ElevenLabs, OpenAI, Azure, Google Cloud e outros.

Arquivos de Áudio e Streams

Processe arquivos de áudio pré-gravados, fontes de streaming ou qualquer provedor PCM personalizado.

Suporte a Personagens

Apesar do nome, o plugin funciona bem além de MetaHumans.

Unreal MetaHuman

Todos os três modelos suportam MetaHumans, com saída de controle facial direta para Realistic e Mood-Enabled.

Sistemas de Personagens Comerciais

O modelo Standard suporta Daz Genesis 8/9, Reallusion CC3/CC4, Mixamo, ReadyPlayerMe e outros por meio de mapeamento flexível de visemas. Realistic e Mood-Enabled também oferecem suporte a eles via ARKit, por exemplo, CC3/CC4 convertidos para ARKit na exportação.

Personagens Personalizados

Qualquer personagem com alvos de morph pode ser configurado. Suporta os sistemas de fonemas FACS, Apple ARKit, Preston Blair e 3ds Max.

Modelo Standard - Exemplos de Personagens Personalizados

Exemplo de personagem personalizado
Exemplo de personagem personalizado

Suporte Universal a Idiomas

O plugin processa fonemas de áudio bruto diretamente, em vez de depender de transcrição de texto, tornando-o inerentemente independente de idioma.

Inglês, Espanhol, Francês, Alemão, Japonês, Chinês, Coreano, Russo, Árabe, Hindi, Português - e qualquer outro idioma falado.

Inglês
Espanhol
Francês
Alemão
Japonês
Chinês
Coreano
+ Qualquer

Referência de Plataforma e Modelo

Referência rápida para suporte a plataformas e capacidades dos modelos.

Capacidade Standard Realistic Mood-Enabled
Controles de animação 14 visemas 81 controles 81 + 12 humores
MetaHuman
Personagens personalizados Via ARKit Via ARKit
Detecção de risadas
Windows
Mac / Linux / iOS
Android / Quest

Vídeos

Demonstrações, tutoriais e passo a passo cobrindo todos os modelos, fontes de áudio e fluxos de trabalho de integração. Todo o conteúdo é compatível com Unreal Engine 5.0 a 5.8.

Demonstração de IA de Fala para Fala

Workflow completo: reconhecimento de fala, chatbot de IA, TTS e sincronização labial em tempo real.

Configuração de Personagem MetaHuman Personalizado

Como adicionar seu próprio personagem MetaHuman ao projeto de demonstração.

Sincronização Labial para Personagens ARKit

Configuração completa de Blueprint de Animação para personagens ARKit, com arquivo de áudio e exemplos de streaming da ElevenLabs.

Piscar de Olhos e Rastreamento do Olhar

Piscar automático e olhar dinâmico que segue a câmera do jogador ou qualquer alvo em movimento, configurável no Blueprint de Animação Facial.

Avatar de IA Conversacional em Tempo Real

Voz, sincronização labial e animação facial rodando ao vivo no Unreal Engine 5.

Demonstração do Modelo Realistic

Demonstração do modelo Realistic com microfone, TTS local, ElevenLabs e vários idiomas.

Sincronização Labial a partir de Arquivo/Buffer de Áudio

Configure uma sincronização labial realista reproduzindo um arquivo de áudio no seu MetaHuman, também funciona com buffers de áudio.

TTS local com modelo com suporte a humor

Síntese de fala offline com sincronização labial de alta qualidade e sensível a emoções, 12 humores com intensidade ajustável.

Integração com TTS externo

Modelo realista com ElevenLabs e OpenAI para saída de qualidade premium.

Microfone ao vivo (Realista)

Sincronização labial em tempo real a partir da entrada do microfone usando o modelo realista.

Microfone ao vivo (Padrão)

Sincronização labial em tempo real eficiente usando o modelo padrão.

Síntese de fala local

Sincronização labial totalmente offline com TTS local, sem necessidade de internet.

Ecossistema de plugins

O Runtime MetaHuman Lip Sync integra-se ao ecossistema mais amplo de plugins do Georgy Dev para criar pipelines completos de personagens interativos.

Runtime Audio Importer

Importar, transmitir e capturar áudio em tempo de execução para gerar animações de sincronização labial a partir de qualquer fonte.

Saiba mais

Runtime Speech Recognizer

Adicionar reconhecimento de fala para personagens interativos que respondem a comandos de voz.

Saiba mais

Runtime Text To Speech

Síntese de fala offline com mais de 2800 vozes, totalmente compatível com todos os modelos de sincronização labial.

Saiba mais

Integrador de Chatbot de IA

Conversas orientadas por IA com respostas em linguagem natural e animação labial sincronizada.

Saiba mais

Runtime Local LLM

Gerar diálogo com LLMs no dispositivo offline e, em seguida, acionar a sincronização labial a partir da fala sintetizada para interações de personagens totalmente offline.

Saiba mais

Documentação e Suporte

Documentação abrangente cobre todos os três modelos - desde a configuração inicial até configuração avançada de personagem, animação emocional e mapeamento personalizado de visemas.

Documentação Completa

Guias passo a passo para todos os modelos, integração com MetaHuman e personagens personalizados

Comunidade e Suporte

Comunidade ativa no Discord com suporte para desenvolvedores

Desenvolvimento Personalizado

Integração personalizada ou desenvolvimento de funcionalidades - [email protected]

Pronto para adicionar sincronização labial ao seu projeto?

Disponível na Fab para UE 5.0 – 5.8. Inclui todos os três modelos, documentação completa e projetos de demonstração.