Runtime MetaHuman Lip Sync | Georgy Dev

Runtime MetaHuman Lip Sync

即時、離線且跨平台的 MetaHuman 與自訂角色口型同步。 通用語言支援 - 適用於任何口說語言,並可在任何平台上運作。 適用於遊戲、互動式資訊站、虛擬製作、數位助理、訓練模擬等。

UE 5.0 – 5.8
Blueprints 與 C++
Windows, Mac, iOS, Linux, Android, Quest
MetaHuman 與自訂角色

選擇您的模型

選擇符合您專案需求的模型 - 從廣泛的平台相容性 到具備情緒表達的電影級臉部動畫。

標準

通用相容性

針對所有支援平台上的即時效能進行最佳化。可搭配 MetaHumans 與 任何具有形變目標的角色。

Standard 模型預覽
  • 14 個視素,具備彈性的 對應
  • 可搭配所有角色 系統
  • 笑聲偵測
  • Windows, Android, Quest
寫實

增強視覺保真度

81 個臉部控制項,用於自然、高品質的口部動作,適用於 MetaHuman 與 ARKit 相容角色。 提供兩種變體:標準寫實版與情緒啟用版,以進行情緒表達。

Realistic 模型預覽
  • 81 個臉部控制項
  • MetaHuman 與 ARKit 相容角色
  • 全臉或僅口部 模式
  • 所有平台,包括 Mac 與 iOS

情緒啟用變體

  • 12 種情緒類型,具備 可設定的強度
  • 快樂、悲傷、憤怒、 自信、興奮與更多

運作方式

此插件直接分析原始音訊音素,無需文字轉錄,因此完全不受語言限制,適用於任何口說語言。

1

音訊輸入

麥克風、TTS 或音訊檔案——任何音訊資料來源

2

音素分析

語言無關的音訊處理,於裝置端執行

3

動畫資料

視位或臉部控制,依可選的情緒情境產生

4

即時播放

套用至角色並帶有平滑的混合過渡

音訊來源

任何提供 PCM 資料的音訊來源均受支援。

麥克風輸入

使用 Runtime Audio Importer 的可捕捉聲波,從即時麥克風擷取進行即時口型同步。

文字轉語音

與本機離線 TTS 及外部服務相容,包括 ElevenLabs、OpenAI、Azure、Google Cloud 等。

音訊檔案與串流

可處理預先錄製的音訊檔案、串流來源,或任何自訂 PCM 提供者。

角色支援

儘管名稱如此,此插件在 MetaHuman 之外也能運作良好。

Unreal MetaHuman

所有三種模型均支援 MetaHuman,其中「寫實」與「情緒啟用」可直接輸出臉部控制。

商業角色系統

標準版模型透過靈活的視素映射支援 Daz Genesis 8/9、Reallusion CC3/CC4、Mixamo、ReadyPlayerMe 等。寫實版與情緒支援版也透過 ARKit 支援這些,例如 CC3/CC4 在匯出時轉換為 ARKit。

自訂角色

任何具有形變目標的角色都可以設定。支援 FACS、Apple ARKit、Preston Blair 與 3ds Max 音素系統。

標準版模型 - 自訂角色範例

自訂角色範例
自訂角色範例

通用語言支援

外掛程式直接處理原始音訊中的音素,而非依賴文字轉錄, 因此本質上與語言無關。

英文、西班牙文、法文、德文、日文、中文、韓文、俄文、阿拉伯文、印地文、 葡萄牙文 - 以及任何其他口說語言。

英文
西班牙文
法文
德文
日文
中文
韓文
+ 任何

平台與模型參考

平台支援與模型功能的快速參考。

功能 標準版 寫實版 情緒支援版
動畫控制器 14 個視素 81 個控制器 81 + 12 種情緒
MetaHuman
自訂角色 透過 ARKit 透過 ARKit
笑聲偵測
Windows
Mac / Linux / iOS
Android / Quest

影片

示範、教學影片和逐步指南,涵蓋所有模型、音訊來源和整合工作流程。所有內容皆相容於 Unreal Engine 5.0 至 5.8。

語音轉語音 AI 示範

完整工作流程:語音辨識、AI 聊天機器人、TTS,以及即時口型同步。

自訂 MetaHuman 角色設定

如何將您自己的 MetaHuman 角色加入示範專案。

適用於 ARKit 角色的口型同步

適用於 ARKit 角色的完整 Animation Blueprint 設定,包含音訊檔案和 ElevenLabs 串流範例。

眨眼與視線追蹤

自動眨眼與動態視線,會跟隨玩家攝影機或任何移動目標,可在臉部 Animation Blueprint 中設定。

即時對話 AI 虛擬化身

語音、口型同步與臉部動畫在 Unreal Engine 5 中即時運作。

擬真模型示範

在麥克風、本機 TTS、ElevenLabs 和多種語言中展示擬真模型。

從音訊檔案/緩衝區進行口型同步

通過在您的 MetaHuman 上播放音訊檔案來設定逼真的口型同步,也適用於音訊緩衝區。

搭載情緒感知模型的本機 TTS

離線文字轉語音,具備情緒感知的高品質口型同步,支援 12 種情緒且強度可調整。

外部 TTS 整合

透過 ElevenLabs 與 OpenAI 提供頂級品質輸出的擬真模型。

即時麥克風(擬真)

使用擬真模型,從麥克風輸入進行即時口型同步。

即時麥克風(標準)

使用標準模型的高效率即時口型同步。

本機文字轉語音

搭配本機 TTS 的完全離線口型同步,無需網際網路。

外掛程式生態系

Runtime MetaHuman Lip Sync 可與更廣泛的 Georgy Dev 外掛程式套件整合,以建構完整的互動角色管線。

Runtime Audio Importer

在執行階段匯入、串流及擷取音訊,以從任何來源驅動口型同步動畫。

深入瞭解

Runtime Speech Recognizer

為互動角色加入語音辨識,使其能回應語音指令。

深入瞭解

Runtime Text To Speech

離線語音合成,內建 2800+ 種聲音,完全相容於所有口型同步模型。

深入瞭解

AI Chatbot Integrator

由 AI 驅動的對話,具備自然語言回應與同步口型動畫。

深入瞭解

Runtime Local LLM

透過裝置端 LLM 離線產生對話,再從合成語音驅動口型同步,實現完全離線的角色互動。

深入瞭解

文件與支援

全面的文件涵蓋全部三種模型,從初始設定到進階角色設定、情緒動畫,以及自訂視素對應。

完整文檔

所有模型、MetaHuman 整合與自訂角色的逐步指南

社群與支援

活躍的 Discord 社群,提供開發者支援

自訂開發

量身打造的整合或功能開發 - [email protected]

準備好為您的專案加入口型同步了嗎?

可在 Fab 上取得,適用於 UE 5.0 – 5.8。包含全部三種模型、完整文檔與示範專案。