Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

Sincronização labial em tempo real, offline e multiplataforma para MetaHuman e personagens personalizados. Suporte universal a idiomas - funciona com qualquer idioma falado, em qualquer plataforma. Adequado para jogos, quiosques interativos, produção virtual, assistentes digitais, simulações de treinamento e muito mais.

UE 5.0 – 5.8
Blueprints e C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman e personagens personalizados

Escolha Seu Modelo

Escolha o modelo que atende aos requisitos do seu projeto - de ampla compatibilidade de plataformas a animação facial com qualidade cinematográfica e expressão emocional.

Padrão

Compatibilidade Universal

Otimizado para desempenho em tempo real em todas as plataformas compatíveis. Funciona com MetaHumans e qualquer personagem com morph targets.

Prévia do modelo Standard
  • 14 visemes com mapeamento flexível
  • Funciona com todos os sistemas de personagens
  • Detecção de riso
  • Windows, Android, Quest
Realista

Fidelidade Visual Aprimorada

81 controles faciais para movimentos de boca naturais e de alta qualidade, para MetaHuman e personagens compatíveis com ARKit. Disponível em duas variantes: a Realista padrão e a Mood-Enabled, para expressão emocional.

Prévia do modelo Realistic
  • 81 controles faciais
  • Personagens MetaHuman e compatíveis com ARKit
  • Modos Rosto Completo ou Somente Boca
  • Todas as plataformas, incluindo Mac e iOS

Variante Mood-Enabled

  • 12 tipos de humor com intensidade configurável
  • Feliz, Triste, Zangado, Confiante, Animado e mais

Como Funciona

O plugin analisa fonemas de áudio bruto diretamente - sem necessidade de transcrição de texto - tornando-o totalmente independente de idioma e adequado para qualquer idioma falado.

1

Entrada de Áudio

Microfone, TTS ou arquivos de áudio - qualquer fonte de dados de áudio

2

Análise de Fonemas

Processamento de áudio independente de idioma, no dispositivo

3

Dados de Animação

Visemas ou controles faciais gerados com contexto de humor opcional

4

Reprodução em Tempo Real

Aplicado ao personagem com transições de blending suaves

Fontes de Áudio

Qualquer fonte de áudio que forneça dados PCM é suportada.

Entrada de Microfone

Lip sync em tempo real a partir da captura de microfone ao vivo usando a onda sonora capturável do Runtime Audio Importer.

Conversão de Texto em Fala

Compatível com TTS local offline e serviços externos, incluindo ElevenLabs, OpenAI, Azure, Google Cloud e muito mais.

Arquivos e Streams de Áudio

Processe arquivos de áudio pré-gravados, fontes de streaming ou qualquer provedor PCM personalizado.

Suporte a Personagens

Apesar do nome, o plugin funciona muito além dos MetaHumans.

Unreal MetaHuman

Todos os três modelos suportam MetaHumans, com saída de controle facial direto para os modelos Realistic e Mood-Enabled.

Sistemas de Personagens Comerciais

O modelo Standard oferece suporte a Daz Genesis 8/9, Reallusion CC3/CC4/CC5, Mixamo e muito mais por meio de mapeamento flexível de visemes. Os modelos Realistic e Mood-Enabled também oferecem suporte a esses por meio do ARKit, por exemplo, CC3/CC4/CC5 convertidos para ARKit na exportação.

Personagens Personalizados

Qualquer personagem com morph targets pode ser configurado. Oferece suporte aos sistemas de fonemas FACS, Apple ARKit, Preston Blair e 3ds Max.

Modelo Standard - Exemplos de Personagens Personalizados

Exemplo de personagem personalizado
Exemplo de personagem personalizado

Suporte Universal a Idiomas

O plugin processa fonemas de áudio brutos diretamente, em vez de depender de transcrição de texto, o que o torna inerentemente independente de idioma.

Inglês, Espanhol, Francês, Alemão, Japonês, Chinês, Coreano, Russo, Árabe, Hindi, Português - e qualquer outro idioma falado.

Inglês
Espanhol
Francês
Alemão
Japonês
Chinês
Coreano
+ Qualquer

Referência de Plataforma e Modelo

Referência rápida para suporte a plataformas e capacidades dos modelos.

Capacidade Standard Realistic Mood-Enabled
Controles de animação 14 visemes 81 controles 81 + 12 humores
MetaHuman
Personagens personalizados Via ARKit Via ARKit
Detecção de riso
Windows
Mac / Linux / iOS
Android / Quest

Vídeos

Demos, tutoriais e walkthroughs cobrindo todos os modelos, fontes de áudio e fluxos de trabalho de integração. Todo o conteúdo é compatível com Unreal Engine 5.0 até 5.8.

Demonstração de IA de Fala para Fala

Fluxo de trabalho completo: reconhecimento de fala, chatbot de IA, TTS e sincronização labial em tempo real.

Configuração de personagem MetaHuman personalizado

Como adicionar seu próprio personagem MetaHuman ao projeto de demonstração.

Sincronização labial para personagens ARKit

Configuração completa de Animation Blueprint para personagens ARKit, com exemplos de arquivo de áudio e streaming da ElevenLabs.

Piscar de olhos e rastreamento de olhar

Piscar automático e olhar dinâmico que segue a câmera do jogador ou qualquer alvo em movimento, configurável no Face Animation Blueprint.

Avatar de IA conversacional em tempo real

Voz, sincronização labial e animação facial em execução ao vivo no Unreal Engine 5.

Demonstração básica de sincronização labial

Demonstração do modelo Realistic com microfone, TTS local, ElevenLabs e vários idiomas.

Sincronização labial a partir de arquivo/buffer de áudio

Configure uma sincronização labial realista reproduzindo um arquivo de áudio no seu MetaHuman, também funciona com buffers de áudio.

Lip Sync a partir de um Servidor Remoto

Controle o lip sync em tempo real a partir de uma fonte de áudio em streaming via WebSocket, com o áudio importado e processado chunk a chunk.

TTS Local com Modelo com Suporte a Humor

Text-to-speech offline com lip sync de alta qualidade sensível a emoções, 12 humores com intensidade ajustável.

Integração com TTS Externo

Modelo realista com ElevenLabs e OpenAI para uma saída de qualidade premium.

Microfone ao Vivo (Realistic)

Lip sync em tempo real a partir da entrada do microfone usando o modelo Realistic.

Text-to-Speech Local

Lip sync totalmente offline com TTS local, sem necessidade de internet.

Ecossistema de Plugins

O Runtime MetaHuman Lip Sync integra-se ao amplo conjunto de plugins da Georgy Dev para construir pipelines completos de personagens interativos.

Runtime Audio Importer

Importe, transmita e capture áudio em tempo de execução para conduzir animações de lip sync a partir de qualquer fonte.

Saiba mais

Runtime Speech Recognizer

Adicione reconhecimento de fala para personagens interativos que respondem a comandos de voz.

Saiba mais

Runtime Text To Speech

Síntese de fala offline com mais de 2800 vozes, totalmente compatível com todos os modelos de lip sync.

Saiba mais

AI Chatbot Integrator

Conversas orientadas por AI com respostas em linguagem natural e animação labial sincronizada.

Saiba mais

Runtime Local LLM

Gere diálogos com LLMs no dispositivo de forma offline e, em seguida, conduza o lip sync a partir da fala sintetizada para interações de personagens totalmente offline.

Saiba mais

Documentação e Suporte

A documentação abrangente cobre todos os três modelos - desde a configuração inicial até a configuração avançada de personagens, animação emocional e mapeamento personalizado de visemes.

Documentação Completa

Guias passo a passo para todos os modelos, integração com MetaHuman e personagens personalizados

Comunidade e Suporte

Comunidade ativa no Discord com suporte de desenvolvedores

Desenvolvimento Personalizado

Integração sob medida ou desenvolvimento de recursos - [email protected]

Pronto para Adicionar Sincronização Labial ao Seu Projeto?

Disponível no Fab para UE 5.0 – 5.8. Inclui todos os três modelos, documentação completa e projetos de demonstração.