Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

实时、离线、跨平台的 MetaHuman 和自定义角色口型同步。 通用语言支持——适用于任何语言、任何平台。 适用于游戏、交互式自助终端、虚拟制作、数字助理、培训模拟等场景。

UE 5.0 – 5.8
Blueprints 与 C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman 与自定义角色

选择您的模型

选择符合项目需求的模型——从广泛的平台兼容性 到具有情感表达的影视级面部动画。

标准

通用兼容性

针对所有受支持平台优化了实时性能。适用于 MetaHumans 以及 任何带有形态目标的角色。

Standard 模型预览
  • 14 个视位,支持灵活 映射
  • 适用于所有角色 系统
  • 笑声检测
  • Windows, Android, Quest
写实

增强视觉保真度

81 个面部控制,用于实现自然、高质量的口部运动,适用于 MetaHuman 和兼容 ARKit 的角色。 提供两种变体:标准写实版和支持情绪表达的情绪启用版。

Realistic 模型预览
  • 81 个面部控制
  • MetaHuman 与兼容 ARKit 的角色
  • 全脸或仅口部 模式
  • 所有平台,包括 Mac 与 iOS

情绪启用变体

  • 12 种情绪类型, 可配置强度
  • 快乐、悲伤、愤怒、 自信、兴奋等

工作原理

该插件直接分析原始音频音素——无需文本转录——因此完全与语言无关,适用于任何口语。

1

音频输入

麦克风、TTS 或音频文件——任何音频数据源

2

音素分析

语言无关的音频处理,设备端完成

3

动画数据

视位或面部控制,生成时支持可选情绪上下文

4

实时播放

应用于角色,并带有平滑混合过渡

音频源

支持任何提供 PCM 数据的音频源。

麦克风输入

通过 Runtime Audio Importer 的可捕获声波,从实时麦克风采集实现实时口型同步。

文本转语音

兼容本地离线 TTS 及外部服务,包括 ElevenLabs、OpenAI、Azure、Google Cloud 等。

音频文件与流

处理预先录制的音频文件、流媒体源或任何自定义 PCM 提供程序。

角色支持

尽管名称如此,该插件远不止支持 MetaHuman。

Unreal MetaHuman

所有三个模型都支持 MetaHuman,其中写实和情绪启用模式可直接输出面部控制。

商业角色系统

Standard 模型通过灵活的视素映射支持 Daz Genesis 8/9、Reallusion CC3/CC4、Mixamo、ReadyPlayerMe 等。Realistic 和 Mood-Enabled 也通过 ARKit 支持这些,例如 CC3/CC4 在导出时转换为 ARKit。

自定义角色

任何具有变形目标的角色都可以配置。支持 FACS、Apple ARKit、Preston Blair 和 3ds Max 音素系统。

Standard 模型 - 自定义角色示例

自定义角色示例
自定义角色示例

通用语言支持

该插件直接处理原始音频音素,而不是依赖文本转录, 因此它本质上与语言无关。

英语、西班牙语、法语、德语、日语、中文、韩语、俄语、阿拉伯语、印地语、 葡萄牙语——以及任何其他口语。

英语
西班牙语
法语
德语
日语
中文
韩语
+ 任意

平台与模型参考

平台支持和模型能力的快速参考。

能力 Standard Realistic Mood-Enabled
动画控制 14 个视素 81 个控制器 81 + 12 种情绪
MetaHuman
自定义角色 通过 ARKit 通过 ARKit
笑声检测
Windows
Mac / Linux / iOS
Android / Quest

视频

演示、教程和操作指南,涵盖所有模型、音频源和集成工作流程。所有内容均兼容 Unreal Engine 5.0 至 5.8。

语音转语音 AI 演示

完整工作流程:语音识别、AI 聊天机器人、TTS 和实时 口型同步。

自定义 MetaHuman 角色设置

如何将您自己的 MetaHuman 角色添加到演示项目。

ARKit 角色的口型同步

适用于 ARKit 角色的完整动画蓝图设置,包含音频文件和 ElevenLabs 流式示例。

眨眼与视线追踪

自动眨眼和动态视线,可跟随玩家摄像机或任何 移动目标,并可在面部动画蓝图中配置。

实时对话式 AI 虚拟化身

语音、口型同步和面部动画在 Unreal Engine 5 中实时运行。

Realistic 模型演示

展示 Realistic 模型在麦克风、本地 TTS、ElevenLabs 以及 多种语言中的表现。

从音频文件/缓冲区生成口型同步

在 MetaHuman 上播放音频文件即可设置逼真的口型同步,同时 也适用于音频缓冲区。

支持情绪模型的本地TTS

离线文本转语音,具备情绪感知的高质量口型同步,12种情绪且强度可调。

外部TTS集成

使用ElevenLabs和OpenAI的Realistic模型,提供高品质 输出。

实时麦克风(Realistic)

使用Realistic模型,根据麦克风输入实时生成口型同步。

实时麦克风(Standard)

使用Standard模型,实现高效的实时口型同步。

本地文本转语音

完全离线的口型同步,搭配本地TTS,无需互联网。

插件生态系统

Runtime MetaHuman Lip Sync 与更广泛的 Georgy Dev 插件套件集成,用于构建完整的交互式角色管线。

Runtime Audio Importer

在运行时导入、流式传输和捕获音频,以驱动口型同步动画 来自任何来源。

了解更多

Runtime Speech Recognizer

为交互式角色添加语音识别功能,使其能够响应语音 命令。

了解更多

Runtime Text To Speech

离线语音合成,拥有2800多种音色,与所有口型 同步模型完全兼容。

了解更多

AI Chatbot Integrator

由AI驱动的对话,具备自然语言响应和同步 口型动画。

了解更多

Runtime Local LLM

利用设备端LLM离线生成对话,然后从 合成的语音驱动口型同步,实现完全离线的角色交互。

了解更多

文档与支持

全面的文档涵盖了所有三种模型——从初始设置到高级角色配置、情感动画以及自定义视位映射。

完整文档

所有模型、MetaHuman 集成和自定义角色的分步指南

社区与支持

活跃的 Discord 社区,提供开发者支持

定制开发

定制集成或功能开发 - [email protected]

准备好为您的项目添加口型同步功能了吗?

可在 Fab 上获取,适用于 UE 5.0 – 5.8。包含全部三种模型、完整文档和演示项目。