Zum Hauptinhalt springen

Übersicht

Runtime AI Chatbot Integrator Documentation

Runtime AI Chatbot Integrator ist ein plattformübergreifendes Unreal Engine-Plugin, das die nahtlose Integration von AI-Chatbots und Text-to-Speech-Diensten direkt in Ihre Projekte ermöglicht. Das Plugin unterstützt mehrere führende AI-Anbieter und bietet flexible Chat-Interaktionen sowohl mit Streaming- als auch mit Nicht-Streaming-Antwortmodi sowie hochwertige Text-to-Speech-Konvertierung mit Streaming-Funktionen.

Unterstützte Funktionen​

Text-zu-Text-Chat​

Integriere KI-gestützte Konversationsfähigkeiten mit mehreren führenden Anbietern.

OpenAI​

  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • GPT-5.6 Luna
  • GPT-5.5
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.4 Nano
  • GPT-5.3
  • GPT-5.2
  • GPT-5.1
  • GPT-5
  • GPT-5 Mini
  • GPT-5 Nano
  • GPT-4-1
  • GPT-4-1 Mini
  • GPT-4-1 Nano
  • GPT-4o
  • GPT-4o Mini
  • GPT-4
  • GPT-4 Turbo
  • GPT-4-32k
  • GPT-3.5 Turbo
  • GPT-3.5 Turbo 16k
  • ChatGPT-4o Latest
  • O1
  • O1 Pro
  • O3
  • O3 Mini
  • O4 Mini

Claude (Anthropic)​

  • Claude 5.5 Opus
  • Claude 5.5 Sonnet
  • Claude 5.1 Fable
  • Claude 5 Opus
  • Claude 5 Sonnet
  • Claude 5 Fable
  • Claude 4.8 Opus
  • Claude 4.7 Opus
  • Claude 4.6 Opus
  • Claude 4.6 Sonnet
  • Claude 4.5 Haiku
  • Claude 4.5 Sonnet
  • Claude 4.5 Opus
  • Claude 4.1 Opus
  • Claude 4 Sonnet
  • Claude 4.0 Opus
  • Claude 3.7 Sonnet
  • Claude 3.5 Haiku
  • Claude 3 Opus

DeepSeek​

  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek Chat
  • DeepSeek Reasoner (mit dedizierter Reasoning-Ausgabe)

Gemini (Google)​

  • Gemini 3.7 Flash
  • Gemini 3.6 Flash
  • Gemini 3.1 Pro
  • Gemini 3.1 Flash Light
  • Gemini 3.5 Flash
  • Gemini 2.5 Pro
  • Gemini Flash Latest
  • Gemini Flash Lite Latest
  • Gemini 2.5 Flash
  • Gemini 2.5 Flash Lite
  • Gemini 2.0 Flash
  • Gemini 2.0 Flash Lite

Grok (xAI)​

  • Grok 4.3
  • Grok 4.1 Schnelles Schlussfolgern
  • Grok 4.1 Schnelles nicht-schlussfolgerndes Denken
  • Grok 4 Schnelles Schlussfolgern
  • Grok 4 Schnelles nicht-schlussfolgerndes Denken
  • Grok Code Schnell 1
  • Grok 4 0709
  • Grok 3
  • Grok 3 Mini
  • Grok 2 Vision 1212

Ollama​

Führe lokale KI-Modelle mit vollständiger Privatsphäre und ohne erforderlichen API-Schlüssel aus:

  • Jedes in der Ollama-Bibliothek verfügbare Modell (z. B. Llama 3, Mistral, Gemma, Phi, Qwen und weitere)
  • Benutzerdefinierte und feinabgestimmte Modelle, die lokal gehostet werden

Text-to-Speech (TTS)​

Konvertieren Sie Text mit führenden TTS-Anbietern in natürlich klingende Sprache, mit sowohl Standard- als auch Streaming-Optionen.

OpenAI TTS​

Mehrere Stimmoptionen mit regulärer und Streaming-Unterstützung:

  • Legierung
  • Asche
  • Ballade
  • Koralle
  • Echo
  • Fabel
  • Onyx
  • Nova
  • Salbei
  • Schimmer
  • Vers

Modelle:

  • TTS-1
  • TTS-1-HD
  • GPT-4o Mini TTS

ElevenLabs TTS​

Mehrere Modelle mit regulärer und Streaming-Unterstützung:

  • Eleven v4 (ElevenLabs' emotional ausdrucksstärkstes und expressivstes Sprachsynthesemodell, mit außergewöhnlichem Voice Cloning, Unterstützung für über 90 Sprachen und natürlichem Multi-Speaker-Dialog)
  • Eleven v4 Turbo (Expressives Echtzeit-Sprachsynthesemodell mit extrem niedriger Latenz (~100 ms Median), außergewöhnlichem Voice Cloning und Unterstützung für über 90 Sprachen)
  • Eleven V3 (Menschenähnliche und expressive Sprachgenerierung, unterstützt über 70 Sprachen)
  • Eleven TTV V3 (Text-zu-Stimme-Designmodell mit menschenähnlicher und expressiver Sprache, unterstützt über 70 Sprachen)
  • Eleven Multilingual V2 (Lebensechte Sprachsynthese mit reichem emotionalem Ausdruck, unterstützt 29 Sprachen)
  • Eleven Turbo V2 (Hochwertiges Modell mit niedriger Latenz, optimiert für Englisch)
  • Eleven Turbo V2.5 (Hochwertiges Modell mit niedriger Latenz und Mehrsprachigkeitsunterstützung)
  • Eleven Flash V2 (Ultraschnelles Modell, optimiert für den Echtzeiteinsatz in Englisch)
  • Eleven Flash V2.5 (Ultraschnelles Modell, optimiert für den Echtzeiteinsatz mit Mehrsprachigkeitsunterstützung)
  • Eleven Monolingual V1

Google Cloud TTS​

Hochwertige neuronale Stimmen mit umfangreicher Sprachunterstützung:

  • Neural2-Stimmen
  • Studio-Stimmen
  • Wavenet-Stimmen
  • Standard-Stimmen
  • Unterstützung für benutzerdefinierte Stimmen
  • Mehrere Sprachen und Locales
  • SSML-Unterstützung für feingranulare Steuerung

Azure TTS​

Microsofts kognitiver Sprachdienst mit umfangreichen Stimmoptionen:

  • Neuronale Stimmen in mehreren Sprachen
  • Sprachstile und Emotionen
  • Unterstützung für benutzerdefinierte Stimmen
  • Unterstützung für SSML-Markup

Hauptfunktionen​

  • Plattformübergreifende Kompatibilität (Windows, Mac, Android, iOS, Linux, Meta Quest und mehr)
  • Unterstützung für mehrere AI- und TTS-Anbieter
  • Lokale Modellunterstützung über Ollama (kein API-Schlüssel erforderlich, vollständige Privatsphäre)
  • Streaming- und Nicht-Streaming-Chat-Antworten
  • Streaming-TTS für Echtzeit-Audiosynthese und -verarbeitung
  • Unterstützung für Reasoning-Modelle mit getrennten Reasoning- und Inhaltsausgaben (DeepSeek, Grok)
  • Hochwertige Sprachsynthese mit minimaler Latenz
  • Einfache Integration mit Unreal Engine Blueprints und C++
  • Flexible Konfigurationsoptionen
  • Unterstützung für über 90 Sprachen mit ElevenLabs V4-Modellen
  • Stimmenauflistung und -erkennung für Google Cloud und Azure TTS

Voraussetzungen​

Um das Plugin zu verwenden, benötigen Sie API-Zugangsdaten von einem der unterstützten Anbieter:

Für die Audioverarbeitung kannst du deine eigene Lösung implementieren oder das Plugin Runtime Audio Importer verwenden, das Audiodaten in verschiedenen Formaten importieren kann (MP3, WAV, FLAC, OGG VORBIS, OGG OPUS, BINK, RAW (PCM)). Weitere Informationen findest du hier.

Zusätzliche Ressourcen​

Join our Discord
online · support