跳至主要内容

概述

Runtime MetaHuman Lip Sync Documentation

Runtime MetaHuman Lip Sync 是一個外掛程式,可為 MetaHuman 與自訂角色提供即時、離線且跨平台的口型同步。它能讓您依據各種來源的音訊輸入,驅動角色的嘴唇動畫,包括:

此外掛程式會根據音訊輸入,在內部產生視位(音素的視覺化表現)。由於它直接以音訊資料而非文字運作,此外掛程式支援多語言輸入,包括但不限於英語、西班牙語、法語、德語、日語、中文、韓語、俄語、義大利語、葡萄牙語、阿拉伯語與印地語。實際上任何語言都受支援,因為口型同步是根據音訊中的音素產生,而非特定語言的文字處理。

Standard Model 會產生 14 個視位,並使用預先定義的姿勢資產來執行口型同步動畫。相比之下,Realistic Models(僅限於 MetaHuman 與以 ARKit 為基礎的角色)會產生 81 個臉部控制變化,且無需依賴預先定義的姿勢資產,因此能呈現出顯著更為逼真的臉部動畫。

角色相容性

儘管名稱如此,Runtime MetaHuman Lip Sync 適用於各種角色,而不僅限於 MetaHuman:

  • Daz Genesis 8/9 角色
  • Reallusion Character Creator 3/4/5 (CC3/CC4/CC5) 角色
  • Mixamo 角色

動畫標準支援

  • 基於 FACS 的混合變形系統
  • Apple ARKit 混合變形標準
  • Preston Blair 音素集
  • 3ds Max 音素系統
  • 任何具有用於臉部表情的自訂形變目標的角色

許多熱門系統,包括 Reallusion CC4/CC5Daz Genesis 8.1/9,也能轉換為使用符合 ARKit 標準的混合變形名稱。這讓您可以為這些角色使用 寫實模型,以其更高品質的面部動畫,作為標準模型手動視素對應的替代方案。詳情請參閱 將角色轉換為 ARKit 混合變形

動畫預覽

看看這些簡短動畫,了解外掛程式在不同角色類型與模型上所產生的口型同步動畫品質:

使用 MetaHuman 角色的寫實模型
搭配 MetaHuman 角色的標準模型
標準模型搭配自訂角色
標準模型搭配自訂角色

主要特色

口型同步模型

該外掛程式提供多種口型同步模型,以滿足不同專案需求:

標準口型同步模型提供高效率的跨平台效能,並具備廣泛的角色相容性:

  • 適用於 MetaHuman 與所有自訂角色類型
  • 專為即時效能最佳化
  • 更低的資源需求
  • 平台支援:Windows、Android 與基於 Android 的平台(包括 Meta Quest)
需要擴充功能外掛程式

若要使用 Standard Model,您需要安裝額外的擴充外掛程式。請參閱先決條件一節以取得安裝說明。

您可以根據專案需求,選擇合適的模型,以符合效能、角色相容性、視覺品質、目標平台與功能需求。

運作方式

此外掛程式以下列方式處理音訊輸入:

  1. 音訊資料以浮點 PCM 格式接收,並附帶指定的通道數與取樣率
  2. 外掛程式會處理音訊,依所選模型產生臉部控制資料視位
  3. 針對具情緒功能的模型,會將情緒情境套用至臉部動畫
  4. 動畫資料會即時驅動角色的臉部動作

效能架構

Runtime MetaHuman Lip Sync 僅使用 CPU 進行推論,以提供一致、低延遲的 Lip Sync 結果,適合即時應用程式。預設情況下,外掛程式每 10 毫秒 執行一次 Lip Sync 處理(可調整 - 請參閱 外掛程式設定 以取得所有可用設定,包括 處理區塊大小執行緒數 及其他效能參數)。

模型架構總覽

口型同步模型採用基於 Transformer 的緊湊型神經網路,透過梅爾頻譜圖分析來處理音訊。這種輕量級架構專為即時效能所設計,具備高效的 CPU 推論能力與極低的記憶體佔用。

為什麼使用 CPU 推論?

對於即時口型同步這類小規模、頻繁進行的推論操作,CPU 處理提供了比 GPU 更佳的延遲特性。在 batch size 為 1、推論間隔為 10–100 毫秒的情況下,PCIe 傳輸與 kernel 啟動所造成的 GPU 開銷,往往超過實際的運算時間。此外,在遊戲引擎中,GPU 早已被渲染、著色器與物理運算佔滿,造成資源爭用,進而引入難以預測的延遲尖峰。

硬體相容性

此外掛程式在大多數中階及更高階 CPU 上皆能高效運作,無需專用圖形硬體,即可在桌上型電腦、行動裝置與 VR 平台上提供即時效能。若硬體效能較弱,您可以將模型類型調整為 Semi-OptimizedHighly Optimized,或增大**處理區塊大小**,以維持即時效能,但回應速度會略微降低。

快速入門

以下是為您的角色啟用口型同步的基本設定:

  1. 若使用 MetaHuman 角色,請依照設定指南
  2. 若使用自訂角色,請依照自訂角色設定指南
  3. 選擇並設定您偏好的口型同步模型
  4. 在您的 Blueprint 中設定音訊輸入處理
  5. 在 Animation Blueprint 中連接適當的口型同步節點
  6. 播放音訊,即可看到您的角色同步產生動畫

可選的眼睛動畫

此外掛程式也提供用於 MetaHuman 自動眨眼視線追蹤的選用輔助工具。這些工具與口型同步無關,可獨立使用,也可疊加於口型同步之上。請參閱 眼睛動畫輔助工具

其他資源

📦 下載與連結

示範專案:

提供兩個立即可用的示範專案——如需完整詳細資訊、下載內容與逐步解說,請參閱專屬的示範專案頁面:

兩個示範專案皆為跨平台(Windows、Mac、Linux、iOS、Android、Meta Quest),並以打包建置版本及完整的 UE 5.6+ 源碼專案形式提供。

🎥 影片教學

精選示範:

寫實模型(高品質)教學:

標準模型教學:

一般設定:

💬 支援

Join our Discord
online · support