Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

為 MetaHuman 與自訂角色提供即時、離線且跨平台的唇形同步。 通用語言支援 - 適用於任何口說語言、任何平台。 適合遊戲、互動式資訊站、虛擬製作、數位助理、訓練模擬等應用。

UE 5.0 – 5.8
Blueprint 與 C++
Windows、Mac、iOS、Linux、Android、Quest
MetaHuman 與自訂角色

選擇你的模型

選擇符合你專案需求的模型 - 從廣泛的平台相容性, 到具備情緒表現、電影級品質的臉部動畫。

標準

通用相容性

針對所有支援平台進行即時效能最佳化。可搭配 MetaHuman 以及 任何具有變形目標的角色。

Standard 模型預覽
  • 14 個視素,具備彈性 對應
  • 可搭配所有角色 系統
  • 笑聲偵測
  • Windows、Android、Quest
擬真

增強的視覺保真度

81 項臉部控制,實現自然、高品質的嘴部動作,適用於 MetaHuman 與相容 ARKit 的角色。 提供兩種變體:標準擬真版,以及可展現情緒的 Mood-Enabled 版。

Realistic 模型預覽
  • 81 項臉部控制
  • MetaHuman 與相容 ARKit 的角色
  • 全臉或僅嘴部 模式
  • 所有平台,包括 Mac 與 iOS

情緒模式變體

  • 12 種情緒類型,具備 可設定的強度
  • 開心、悲傷、生氣、 自信、興奮等更多

運作方式

此外掛直接分析原始音訊音素 - 無需文字轉錄 - 因此完全不受語言限制,適用於任何口說語言。

1

音訊輸入

麥克風、TTS 或音訊檔案 - 任何音訊資料來源

2

音素分析

不受語言限制的音訊處理,於裝置端執行

3

動畫資料

產生的視素或臉部控制,可選擇搭配情緒脈絡

4

即時播放

套用至角色,並具備流暢的混合轉場

音訊來源

支援任何提供 PCM 資料的音訊來源。

麥克風輸入

透過 Runtime Audio Importer 的可擷取音效波,從即時麥克風擷取實現即時唇形同步。

文字轉語音

相容於本機離線 TTS 與外部服務,包括 ElevenLabs、OpenAI、Azure、Google Cloud 等。

音訊檔案與串流

處理預先錄製的音訊檔案、串流來源,或任何自訂的 PCM 提供者。

角色支援

儘管名稱如此,此外掛的適用範圍遠超出 MetaHuman。

Unreal MetaHuman

三種模型皆支援 MetaHuman,其中寫實模式與情緒模式可直接輸出臉部控制。

商業角色系統

標準模型透過靈活的視素對應支援 Daz Genesis 8/9、Reallusion CC3/CC4/CC5、Mixamo 等更多項目。寫實與情緒啟用模型也透過 ARKit 支援這些,例如 CC3/CC4/CC5 在匯出時轉換為 ARKit。

自訂角色

任何具有變形目標的角色皆可設定。支援 FACS、Apple ARKit、Preston Blair 及 3ds Max 音素系統。

標準模型 - 自訂角色範例

自訂角色範例
自訂角色範例

通用語言支援

此外掛程式會直接處理原始音訊音素,而非依賴文字轉錄, 使其本質上不受語言限制。

英文、西班牙文、法文、德文、日文、中文、韓文、俄文、阿拉伯文、印地文, 葡萄牙文 - 以及任何其他口語語言。

英文
西班牙文
法文
德文
日文
中文
韓文
+ 任何

平台與模型參考

平台支援與模型功能的快速參考。

功能 標準 寫實 情緒啟用
動畫控制項 14 個視素 81 個控制項 81 + 12 種情緒
MetaHuman
自訂角色 透過 ARKit 透過 ARKit
笑聲偵測
Windows
Mac / Linux / iOS
Android / Quest

影片

涵蓋所有模型、音訊來源與整合工作流程的示範、教學與逐步解說。所有內容皆相容於 Unreal Engine 5.0 至 5.8。

語音轉語音 AI 示範

完整工作流程:語音辨識、AI 聊天機器人、TTS 與即時唇形同步。

自訂 MetaHuman 角色設定

如何將你自己的 MetaHuman 角色加入示範專案。

ARKit 角色的唇形同步

ARKit 角色的完整 Animation Blueprint 設定,包含音訊檔案與 ElevenLabs 串流範例。

眨眼與注視追蹤

自動眨眼與動態注視,可跟隨玩家攝影機或任何移動物件,並可在 Face Animation Blueprint 中設定。

即時對話式 AI 虛擬化身

語音、唇形同步與臉部動畫在 Unreal Engine 5 中即時運行。

基礎唇形同步示範

展示 Realistic 模型在麥克風、本機 TTS、ElevenLabs 與多種語言中的表現。

從音訊檔案/緩衝區進行唇形同步

透過在 MetaHuman 上播放音訊檔案來設定逼真的唇形同步,亦支援音訊緩衝區。

從遠端伺服器進行唇形同步

透過 WebSocket 從串流音訊來源驅動即時唇形同步,音訊會逐塊匯入並處理。

具備情緒模型的本機 TTS

離線文字轉語音,搭配情緒感知的高品質唇形同步,提供 12 種情緒並可調整強度。

外部 TTS 整合

寫實模型搭配 ElevenLabs 與 OpenAI,打造頂級品質的輸出。

即時麥克風(寫實)

使用寫實模型,從麥克風輸入進行即時唇形同步。

本機文字轉語音

搭配本機 TTS 的完全離線唇形同步,無需網際網路。

外掛生態系統

Runtime MetaHuman Lip Sync 可與更廣泛的 Georgy Dev 外掛套件整合,打造完整的互動式角色流程。

Runtime Audio Importer

在執行階段匯入、串流及擷取音訊,以驅動來自任何來源的唇形同步動畫。

深入了解

Runtime Speech Recognizer

加入語音辨識,讓互動式角色能回應語音指令。

深入了解

Runtime Text To Speech

離線語音合成,提供 2800+ 種語音,與所有唇形同步模型完全相容。

深入了解

AI Chatbot Integrator

由 AI 驅動的對話,具備自然語言回應與同步的唇形動畫。

深入了解

Runtime Local LLM

使用裝置端 LLM 離線生成對話,再從合成語音驅動唇形同步,實現完全離線的角色互動。

深入了解

文件與支援

完整的文件涵蓋全部三種模型——從初始設定到進階角色配置、情緒動畫,以及自訂 viseme 對應。

完整說明文件

針對所有模型、MetaHuman 整合與自訂角色的逐步指南

社群與支援

活躍的 Discord 社群,並提供開發者支援

自訂開發

量身打造的整合或功能開發 - [email protected]

準備好為你的專案加入唇形同步了嗎?

已在 Fab 上架,支援 UE 5.0 – 5.8。包含全部三種模型、完整說明文件與示範專案。