Plugin-Konfiguration
Modellkonfiguration
Für einen zuverlässigen Betrieb mit den Realistic- und Mood-Enabled-Realistic-Modellen erstellen Sie den Generator vor jeder neuen Audiowiedergabe neu, anstatt ihn über lange Stille hinweg wiederzuverwenden. Einzelheiten finden Sie unter Neuerstellung des Generators in der Fehlerbehebung.
Standardmodellkonfiguration
Der Create Runtime Viseme Generator-Knoten verwendet Standardeinstellungen, die für die meisten Szenarien gut funktionieren. Die Konfiguration erfolgt über die Eigenschaften des Blending-Knotens im Animation Blueprint.
Informationen zu den Konfigurationsoptionen für Animation Blueprints finden Sie im Abschnitt Lip-Sync-Konfiguration weiter unten.
Realistische Modellkonfiguration
Der Create Realistic MetaHuman Lip Sync Generator-Knoten akzeptiert einen optionalen Konfigurationsparameter, mit dem Sie das Verhalten des Generators anpassen können:
Modelltyp
Die Einstellung Modelltyp bestimmt, welche Version des realistischen Modells verwendet wird:
| Modelltyp | Leistung | Visuelle Qualität | Störgeräuschverhalten | Empfohlene Anwendungsfälle |
|---|---|---|---|---|
| Hochoptimiert (Standard) | Höchste Leistung, geringste CPU-Auslastung | Gute Qualität | Kann bei Hintergrundgeräuschen oder nicht-sprachlichen Geräuschen deutlich sichtbare Mundbewegungen zeigen | Saubere Audio-Umgebungen, leistungskritische Szenarien |
| Teiloptimiert | Gute Leistung, mäßige CPU-Auslastung | Hohe Qualität | Bessere Stabilität bei verrauschtem Audio | Ausgewogene Leistung und Qualität, gemischte Audio-Umgebungen |
| Original | Geeignet für den Echtzeiteinsatz auf modernen CPUs | Höchste Qualität | Am stabilsten bei Hintergrundgeräuschen und nicht-sprachlichen Geräuschen | Hochwertige Produktionen, verrauschte Audio-Umgebungen, wenn maximale Genauigkeit erforderlich ist |
Leistungseinstellungen
Intra-Operation-Threads: Steuert die Anzahl der Threads, die für interne Modellverarbeitungsvorgänge verwendet werden.
- 0 (Standard/Automatisch): Verwendet automatische Erkennung (normalerweise 1/4 der verfügbaren CPU-Kerne, maximal 4)
- 1-16: Geben Sie die Anzahl der Threads manuell an. Höhere Werte können die Leistung auf Mehrkernsystemen verbessern, verbrauchen aber mehr CPU.
Inter Op Threads: Steuert die Anzahl der Threads, die für die parallele Ausführung verschiedener Modelloperationen verwendet werden.
- 0 (Standard/Automatisch): Verwendet automatische Erkennung (typischerweise 1/8 der verfügbaren CPU-Kerne, maximal 2)
- 1-8: Manuell die Thread-Anzahl festlegen. Normalerweise niedrig gehalten für Echtzeitverarbeitung.
Verarbeitungsblockgröße
Die Verarbeitungs-Chunk-Größe bestimmt, wie viele Samples in jedem Inferenzschritt verarbeitet werden. Der Standardwert ist 160 Samples (10 ms Audio bei 16 kHz):
- Kleinere Werte liefern häufigere Updates, erhöhen aber die CPU-Auslastung.
- Größere Werte reduzieren die CPU-Last, können aber die Lip-Sync-Reaktionsfähigkeit verringern.
- Für eine optimale Ausrichtung wird empfohlen, Vielfache von 160 zu verwenden.

Stimmungsbasierte Modellkonfiguration
Der Create Realistic MetaHuman Lip Sync With Mood Generator-Knoten bietet zusätzliche Konfigurationsoptionen über das grundlegende realistische Modell hinaus:
Basiskonfiguration
Lookahead Ms: Lookahead-Zeit in Millisekunden für eine verbesserte Lippensynchronisationsgenauigkeit.
- Standard: 80ms
- Bereich: 20ms bis 200ms (muss durch 20 teilbar sein)
- Höhere Werte sorgen für eine bessere Synchronisation, erhöhen jedoch die Latenz.
Ausgabetyp: Steuert, welche Gesichtssteuerungen generiert werden.
- Ganzes Gesicht: Alle 81 Gesichtssteuerungen (Augenbrauen, Augen, Nase, Mund, Kiefer, Zunge)
- Nur Mund: Nur Steuerungen für Mund, Kiefer und Zunge
Leistungseinstellungen: Verwendet dieselben Intra-Op-Threads- und Inter-Op-Threads-Einstellungen wie das reguläre realistische Modell.
Stimmungseinstellungen
Verfügbare Stimmungen:
- Neutral, Glücklich, Traurig, Ekel, Wut, Überraschung, Angst
- Selbstbewusst, Aufgeregt, Gelangweilt, Verspielt, Verwirrt
Stimmungsintensität: Steuert, wie stark die Stimmung die Animation beeinflusst (0.0 bis 1.0)
Laufzeit-Stimmungskontrolle
Sie können die Stimmungseinstellungen während der Laufzeit mit den folgenden Funktionen anpassen:
- Stimmung festlegen: Ändert den aktuellen Stimmungstyp
- Stimmungsintensität festlegen: Passt an, wie stark die Stimmung die Animation beeinflusst (0.0 bis 1.0)
- Lookahead (ms) festlegen: Ändert die Lookahead-Zeit für die Synchronisierung
- Ausgabetyp festlegen: Wechselt zwischen Ganzgesicht- und Nur-Mund-Steuerung

Leitfaden zur Stimmungsauswahl
Wählen Sie passende Stimmungen basierend auf Ihrem Inhalt:
| Mood | Am besten für | Typischer Intensitätsbereich |
|---|---|---|
| Neutral | Allgemeine Konversation, Erzählung, Standardzustand | 0,5 - 1,0 |
| Glücklich | Positive Inhalte, fröhliche Dialoge, Feierlichkeiten | 0.6 - 1.0 |
| Traurig | Melancholischer Inhalt, emotionale Szenen, düstere Momente. | 0.5 - 0.9 |
| Ekel | Negative Reaktionen, geschmackloser Inhalt, Ablehnung. | 0.4 - 0.8 |
| Wut | Aggressiver Dialog, konfrontative Szenen, Frustration | 0.6 - 1.0 |
| Überraschung | Unerwartete Ereignisse, Enthüllungen, Schockreaktionen | 0.7 - 1.0 |
| Angst | Bedrohliche Situationen, Angst, nervöser Dialog | 0.5 - 0.9 |
| Selbstbewusst | Professionelle Präsentationen, Führungsdialog, selbstbewusstes Sprechen | 0.7 - 1.0 |
| Aufgeregt | Energetische Inhalte, Ankündigungen, enthusiastischer Dialog | 0,8 - 1,0 |
| gelangweilt | Monotoner Inhalt, desinteressierter Dialog, müde Sprache. | 0.3 - 0.7 |
| Verspielt | Zwanglose Unterhaltung, Humor, unbeschwerte Interaktionen. | 0.6 - 0.9 |
| Verwirrt | Fragelastiger Dialog, Unsicherheit, Verwirrung | 0.4 - 0.8 |
Animation Blueprint Konfiguration
Lip Sync-Konfiguration
- Standardmodell
- Realistische Modelle
Der Knoten Blend Runtime MetaHuman Lip Sync verfügt über Konfigurationsoptionen in seinem Eigenschaftenbereich:
| Eigenschaft | Standard | Beschreibung |
|---|---|---|
| Interpolationsgeschwindigkeit | 25 | Steuert, wie schnell die Lippenbewegungen zwischen Visemen wechseln. Höhere Werte führen zu schnelleren, abrupteren Übergängen. |
| Rücksetzzeit | 0.2 | Die Dauer in Sekunden, nach der die Lippensynchronisation zurückgesetzt wird. Dies ist nützlich, um zu verhindern, dass die Lippensynchronisation fortgesetzt wird, nachdem das Audio gestoppt wurde. |
Lach-Animation
Sie können auch Lachanimationen hinzufügen, die dynamisch auf im Audio erkanntes Lachen reagieren:
- Fügen Sie den Knoten
Blend Runtime MetaHuman Laughterhinzu - Verbinden Sie Ihre Variable
RuntimeVisemeGeneratormit dem PinViseme Generator - Wenn Sie bereits Lip-Sync verwenden:
- Verbinden Sie die Ausgabe des Knotens
Blend Runtime MetaHuman Lip Syncmit demSource Posedes KnotensBlend Runtime MetaHuman Laughter. - Verbinden Sie die Ausgabe des Knotens
Blend Runtime MetaHuman Laughtermit demResult-Pin des KnotensOutput Pose.
- Verbinden Sie die Ausgabe des Knotens
- Wenn nur Lachen ohne Lippensynchronisation verwendet wird:
- Verbinden Sie Ihre Quellpose direkt mit dem
Source Pose-Eingang desBlend Runtime MetaHuman Laughter-Knotens - Verbinden Sie den Ausgang mit dem
Result-Pin.
- Verbinden Sie Ihre Quellpose direkt mit dem

Wenn im Audio Lachen erkannt wird, animiert sich dein Charakter entsprechend dynamisch:
Lachkonfiguration
Der Blend Runtime MetaHuman Laughter-Knoten hat seine eigenen Konfigurationsoptionen:
| Eigenschaft | Standard | Beschreibung |
|---|---|---|
| Interpolationsgeschwindigkeit | 25 | Steuert, wie schnell die Lippenbewegungen zwischen Lachanimationen wechseln. Höhere Werte führen zu schnelleren, abrupteren Übergängen. |
| Rücksetzzeit | 0.2 | Die Dauer in Sekunden, nach der das Lachen zurückgesetzt wird. Dies ist nützlich, um zu verhindern, dass das Lachen nach dem Stoppen des Audios fortgesetzt wird. |
| Maximales Lachgewicht | 0.7 | Skaliert die maximale Intensität der Lachanimation (0.0 - 1.0). |
Hinweis: Die Lachdetektion ist derzeit nur mit dem Standardmodell verfügbar.
Der Blend Realistic MetaHuman Lip Sync-Knoten hat Konfigurationsoptionen in seinem Eigenschaftenpanel:
| Eigenschaft | Standard | Beschreibung |
|---|---|---|
| Interpolationsgeschwindigkeit | 30 | Steuert, wie schnell Gesichtsausdrücke während aktiver Sprache wechseln. Höhere Werte führen zu schnelleren, abrupteren Übergängen. |
| Interpolationsgeschwindigkeit im Ruhezustand | 15 | Steuert, wie schnell Gesichtsausdrücke in den Ruhe-/Neutralzustand zurückwechseln. Niedrigere Werte erzeugen sanftere, allmählichere Rückkehr in die Ruhepose. |
| Rücksetzzeit | 0.2 | Dauer in Sekunden, nach der die Lippensynchronisation in den Ruhezustand zurückgesetzt wird. Nützlich, um zu verhindern, dass Ausdrücke nach dem Stoppen des Audios fortgesetzt werden. |
| Ruhezustand beibehalten | false | Wenn aktiviert, wird der letzte emotionale Zustand während Ruhephasen beibehalten, anstatt auf neutral zurückgesetzt zu werden. |
| Augenausdrücke beibehalten | true | Steuert, ob augenbezogene Gesichtssteuerungen während des Ruhezustands beibehalten werden. Nur wirksam, wenn Ruhezustand beibehalten aktiviert ist. |
| Augenbrauenausdrücke beibehalten | true | Steuert, ob augenbrauenbezogene Gesichtssteuerungen während des Ruhezustands beibehalten werden. Nur wirksam, wenn Ruhezustand beibehalten aktiviert ist. |
| Mundform beibehalten | false | Steuert, ob Steuerungen der Mundform (mit Ausnahme sprachspezifischer Bewegungen wie Zunge und Kiefer) während des Ruhezustands beibehalten werden. Nur wirksam, wenn Ruhezustand beibehalten aktiviert ist. |
Erhaltung des Ruhezustands
Die Funktion Leerlaufzustand beibehalten befasst sich damit, wie das realistische Modell mit Stilleperioden umgeht. Anders als das Standardmodell, das diskrete Visemen verwendet und während der Stille konsequent zu Nullwerten zurückkehrt, kann das neuronale Netz des realistischen Modells eine subtile Gesichtspositionierung beibehalten, die sich von der standardmäßigen Ruhepose des MetaHuman unterscheidet.
Wann aktivieren:
- Aufrechterhaltung emotionaler Ausdrücke zwischen Sprachsegmenten
- Bewahrung der Persönlichkeitsmerkmale von Charakteren
- Sicherstellung der visuellen Kontinuität in filmischen Sequenzen
Regionale Steuerungsoptionen:
- Augenausdrücke: Bewahrt das Zusammenkneifen der Augen, das Weiten und die Augenlidstellung.
- Brauenausdrücke: Bewahrt die Positionierung von Augenbrauen und Stirn.
- Mundform: Bewahrt die allgemeine Mundkrümmung, während Sprachbewegungen (Zunge, Kiefer) zurückgesetzt werden können.
Kombinieren mit vorhandenen Animationen
Ziehst du Videos dem Lesen vor? Schau dir das Video-Tutorial an, das genau diese Einrichtung behandelt.
Um Lip Sync und Lachen zusammen mit vorhandenen Körperanimationen und benutzerdefinierten Gesichtsanimationen anzuwenden, ohne sie zu überschreiben:
Dieses Setup gilt für das Gesichts-Animation-Blueprint, da die Lippensynchronisation nicht Teil des Körper-Animation-Blueprints ist. Für benutzerdefinierte Körperanimationen (z. B. Rumpf, Arme und andere Körperbewegungen) verbinden Sie einfach Ihre Animationssequenz (über einen Sequence Player) direkt mit der Ausgabepose im Körper-Animation-Blueprint. Dort ist keine zusätzliche Einrichtung erforderlich.
- Fügen Sie einen
Layered blend per bone-Knoten zwischen Ihren Körperanimationen und der finalen Ausgabe hinzu. Stellen Sie sicher, dassUse Attached Parentauf true gesetzt ist. - Konfigurieren Sie das Layer-Setup:
- Fügen Sie dem
Layer Setup-Array 1 Element hinzu. - Fügen Sie 3 Elemente zu den
Branch Filtersfür die Ebene hinzu, mit den folgendenBone Names:FACIAL_C_FacialRootFACIAL_C_Neck2RootFACIAL_C_Neck1Root
- Fügen Sie dem
- Wichtig für benutzerdefinierte Gesichtsanimationen: Wählen Sie in der
Curve Blend Optiondie Option "Use Max Value". Dadurch können benutzerdefinierte Gesichtsanimationen (Ausdrücke, Emotionen usw.) ordnungsgemäß über dem Lip Sync geschichtet werden. - Stellen Sie die Verbindungen her:
- Ihre benutzerdefinierte Animation (in der Regel ein
Sequence Playermit dem gewünschten Animationssequenz-Asset) →Base Pose-Eingang - Ausgabe der Gesichtsanimation (von Lip-Sync- und/oder Lachknoten) →
Blend Poses 0-Eingang - Ebenen-Überblendungsknoten → finale
Result-Pose
- Ihre benutzerdefinierte Animation (in der Regel ein

Auswahl des Morph-Ziel-Satzes
- Standardmodell
- Realistische Modelle
Das Standardmodell verwendet Pose-Assets, die über das benutzerdefinierte Pose-Asset-Setup von Natur aus jede Morph-Target-Benennungskonvention unterstützen. Es ist keine weitere Konfiguration erforderlich.
Der Blend Realistic MetaHuman Lip Sync-Knoten enthält eine Eigenschaft namens Morph-Ziel-Set, die bestimmt, welche Benennungskonvention für Morph-Ziele bei der Gesichtsanimation verwendet werden soll:
| Morph-Ziel-Set | Beschreibung | Anwendungsfälle |
|---|---|---|
| MetaHuman (Standard) | Standard-MetaHuman-Morph-Ziel-Namen (z. B. CTRL_expressions_jawOpen) | MetaHuman-Charaktere |
| ARKit | Apple-ARKit-kompatible Namen (z. B. JawOpen, MouthSmileLeft) | ARKit-basierte Charaktere |
Feinabstimmung des Lip-Sync-Verhaltens
Skalierung spezifischer Lip-Sync-Kurven
Sie können einzelne Gesichtsbewegungen, die durch die Lippensynchronisation erzeugt werden, mithilfe eines Modify Curve-Knotens abschwächen (oder verstärken). Dies ist nützlich, wenn eine bestimmte Kurve für Ihr Audiomaterial oder Ihren Charakter zu ausgeprägt wirkt.
Einrichtung:
- Fügen Sie nach Ihrem Blend-Knoten für Lip Sync einen
Modify Curve-Knoten hinzu. - Klicken Sie mit der rechten Maustaste auf den Knoten, wählen Sie Add Curve Pin und geben Sie dann den Namen der Kurve ein, die Sie skalieren möchten.
- Setzen Sie die Eigenschaft Apply Mode des Knotens auf Scale.
- Stellen Sie den Parameter Value ein: Werte unter 1,0 dämpfen die Bewegung, Werte über 1,0 verstärken sie (z. B. 0,8 = 20 % Reduzierung).
Häufig skalierte Kurven:
| Kurvenname | Zweck | Gilt für | Typische Anpassung |
|---|---|---|---|
CTRL_expressions_tongueOut | Vorwärtsstrecken der Zunge bei bestimmten Phonemen | Standardmodell | 0.8 zur Reduzierung des Herausstreckens |
CTRL_expressions_jawOpen | Kieferöffnungsbereich | Realistische Modelle | 0.9 zur Reduzierung der Kieferbewegung |
Sie können mehrere Kurven-Pins zum selben Modify Curve-Knoten hinzufügen, um mehrere Kurven gleichzeitig zu skalieren.
Stimmungsspezifische Feinabstimmung
Bei stimmungsfähigen Modellen können Sie bestimmte emotionale Ausdrücke feinabstimmen:
Augenbrauensteuerung:
CTRL_expressions_browRaiseInL/CTRL_expressions_browRaiseInR- Anheben der inneren AugenbraueCTRL_expressions_browRaiseOuterL/CTRL_expressions_browRaiseOuterR- Anheben der äußeren AugenbraueCTRL_expressions_browDownL/CTRL_expressions_browDownR- Senken der Augenbraue
Augenausdruckssteuerung:
CTRL_expressions_eyeSquintInnerL/CTRL_expressions_eyeSquintInnerR- AugenzusammenkneifenCTRL_expressions_eyeCheekRaiseL/CTRL_expressions_eyeCheekRaiseR- Wangenheben
Modellvergleich und -auswahl
Auswahl zwischen Modellen
Bei der Wahl des Lip-Sync-Modells für Ihr Projekt sollten Sie diese Faktoren berücksichtigen:
| Überlegung | Standardmodell | Realistisches Modell | Stimmungsgesteuertes realistisches Modell |
|---|---|---|---|
| Charakterkompatibilität | MetaHumans und alle benutzerdefinierten Charaktertypen | MetaHumans (und ARKit) Charaktere | MetaHumans (und ARKit) Charaktere |
| Visuelle Qualität | Gute Lippensynchronisation mit effizienter Leistung | Verbesserter Realismus mit natürlicheren Mundbewegungen | Verbesserter Realismus mit emotionalen Ausdrücken |
| Leistung | Optimiert für alle Plattformen, einschließlich Mobilgeräte/VR. | Höhere Ressourcenanforderungen | Höhere Ressourcenanforderungen |
| Funktionen | 14 Viseme, Lacherkennung | 81 Gesichtssteuerungen, 3 Optimierungsstufen | 81 Gesichtssteuerungen, 12 Stimmungen, konfigurierbare Ausgabe |
| Plattformunterstützung | Windows, Android, Quest | Windows, Mac, iOS, Linux, Android, Quest | Windows, Mac, iOS, Linux, Android, Quest |
| Anwendungsfälle | Allgemeine Anwendungen, Spiele, VR/AR, Mobil | Filmische Erlebnisse, Nahaufnahme-Interaktionen | Emotionales Geschichtenerzählen, erweiterte Charakterinteraktion |
Engine-Versionskompatibilität
Wenn Sie Unreal Engine 5.2 verwenden, funktionieren die Realistic Models möglicherweise nicht korrekt, da ein Fehler in der Resampling-Bibliothek von UE vorliegt. Für Benutzer von UE 5.2, die eine zuverlässige Lippensynchronisation benötigen, verwenden Sie bitte stattdessen das Standard Model.
Dieses Problem betrifft speziell UE 5.2 und wirkt sich nicht auf andere Engine-Versionen aus.
Leistungsempfehlungen
- Für die meisten Projekte bietet das Standardmodell eine hervorragende Balance zwischen Qualität und Leistung.
- Verwenden Sie das realistische Modell, wenn Sie die höchste visuelle Wiedergabetreue für MetaHuman-Charaktere benötigen.
- Verwenden Sie das realistische Modell mit Stimmungssteuerung, wenn die Steuerung des emotionalen Ausdrucks für Ihre Anwendung wichtig ist.
- Berücksichtigen Sie die Leistungsfähigkeiten Ihrer Zielplattform, wenn Sie zwischen Modellen wählen.
- Testen Sie verschiedene Optimierungsstufen, um die beste Balance für Ihren spezifischen Anwendungsfall zu finden.
Fehlerbehebung
Häufige Probleme
Generator-Neuerstellung für Realistic Models: Für einen zuverlässigen und konsistenten Betrieb mit den Realistic Models wird empfohlen, den Generator jedes Mal neu zu erstellen, wenn Sie nach einer Zeit der Inaktivität neue Audiodaten einspeisen möchten. Dies liegt am Verhalten der ONNX Runtime, das dazu führen kann, dass die Lippensynchronisation nicht mehr funktioniert, wenn Generatoren nach Phasen der Stille wiederverwendet werden.
Zum Beispiel könnten Sie den Lip-Sync-Generator bei jedem Wiedergabestart neu erstellen, etwa wenn Sie Play Sound 2D aufrufen oder eine andere Methode verwenden, um die Sound-Wave-Wiedergabe und Lip Sync zu starten:

Plugin-Speicherort für die Runtime Text To Speech-Integration: Wenn Sie Runtime MetaHuman Lip Sync zusammen mit Runtime Text To Speech verwenden (beide Plugins verwenden ONNX Runtime), können Probleme auftreten, wenn die Plugins im Marketplace-Ordner der Engine installiert sind. So beheben Sie das Problem:
- Suchen Sie beide Plugins in Ihrem UE-Installationsordner unter
\Engine\Plugins\Marketplace(z. B.C:\Program Files\Epic Games\UE_5.6\Engine\Plugins\Marketplace) - Verschieben Sie sowohl den Ordner
RuntimeMetaHumanLipSyncals auch den OrdnerRuntimeTextToSpeechin denPlugins-Ordner Ihres Projekts - Falls Ihr Projekt keinen
Plugins-Ordner hat, erstellen Sie einen im selben Verzeichnis wie Ihre.uproject-Datei - Starten Sie den Unreal Editor neu
Dies behebt Kompatibilitätsprobleme, die auftreten können, wenn mehrere auf ONNX Runtime basierende Plugins aus dem Marketplace-Verzeichnis der Engine geladen werden.
Paketierungskonfiguration (Windows): Wenn die Lippensynchronisation in Ihrem paketierten Projekt unter Windows nicht korrekt funktioniert, stellen Sie sicher, dass Sie die Shipping-Buildkonfiguration anstelle von Development verwenden. Die Development-Konfiguration kann Probleme mit der ONNX Runtime der realistischen Modelle in paketierten Builds verursachen.
Um das zu beheben:
- Stellen Sie in Ihren Projekteinstellungen → Paketierung die Build-Konfiguration auf Shipping ein.
- Paketieren Sie Ihr Projekt neu.

In manchen Projekten, die nur Blueprints verwenden, erstellt Unreal Engine möglicherweise weiterhin in der Development-Konfiguration, selbst wenn Shipping ausgewählt ist. Falls das passiert, konvertieren Sie Ihr Projekt in ein C++-Projekt, indem Sie mindestens eine C++-Klasse hinzufügen (sie kann leer sein). Gehen Sie dazu im UE-Editor-Menü zu Werkzeuge → Neue C++-Klasse und erstellen Sie eine leere Klasse. Dies erzwingt, dass das Projekt korrekt in der Shipping-Konfiguration erstellt wird. Ihr Projekt kann funktional ein reines Blueprint-Projekt bleiben; die C++-Klasse wird lediglich für die korrekte Build-Konfiguration benötigt.
Verminderte Lip-Sync-Reaktionsfähigkeit: Wenn Sie feststellen, dass die Lip-Sync-Reaktionsfähigkeit im Laufe der Zeit nachlässt, wenn Sie Streaming Sound Wave oder Capturable Sound Wave verwenden, kann dies durch Speicheransammlung verursacht werden. Standardmäßig wird der Speicher jedes Mal neu zugewiesen, wenn neue Audiodaten angehängt werden. Um dieses Problem zu vermeiden, rufen Sie die Funktion ReleaseMemory regelmäßig auf, um angesammelten Speicher freizugeben, etwa alle 30 Sekunden.
Leistungsoptimierung:
- Passen Sie die Verarbeitungschunkgröße für realistische Modelle basierend auf Ihren Leistungsanforderungen an
- Verwenden Sie passende Threadanzahlen für Ihre Zielhardware
- Ziehen Sie in Betracht, den Ausgabetyp „Mouth Only“ für stimmungsfähige Modelle zu verwenden, wenn keine vollständige Gesichtsanimation erforderlich ist