Zum Hauptinhalt springen

Übersicht

Runtime AI Chatbot Integrator Documentation

Runtime AI Chatbot Integrator ist ein plattformübergreifendes Unreal Engine Plugin, das eine nahtlose Integration von KI-Chatbots und Text-zu-Sprache-Diensten direkt in Ihre Projekte ermöglicht. Das Plugin unterstützt mehrere führende KI-Anbieter und bietet flexible Chat-Interaktionen sowohl mit Streaming- als auch mit Nicht-Streaming-Antwortmodi sowie hochwertige Text-zu-Sprache-Konvertierung mit Streaming-Funktionen.

Unterstützte Funktionen

Text-zu-Text-Chat

Integrieren Sie KI-gestützte Konversationsfähigkeiten mit mehreren führenden Anbietern.

OpenAI

  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • GPT-5.6 Luna
  • GPT-5.5
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.4 Nano
  • GPT-5.3
  • GPT-5.2
  • GPT-5.1
  • GPT-5
  • GPT-5 Mini
  • GPT-5 Nano
  • GPT-4-1
  • GPT-4-1 Mini
  • GPT-4-1 Nano
  • GPT-4o
  • GPT-4o Mini
  • GPT-4
  • GPT-4 Turbo
  • GPT-4-32k
  • GPT-3.5 Turbo
  • GPT-3.5 Turbo 16k
  • ChatGPT-4o Latest
  • O1
  • O1 Pro
  • O3
  • O3 Mini
  • O4 Mini

Claude (Anthropic)

  • Claude 5 Opus
  • Claude 5 Sonnet
  • Claude 5 Fable
  • Claude 4.8 Opus
  • Claude 4.7 Opus
  • Claude 4.6 Opus
  • Claude 4.6 Sonnet
  • Claude 4.5 Haiku
  • Claude 4.5 Sonnet
  • Claude 4.5 Opus
  • Claude 4.1 Opus
  • Claude 4 Sonnet
  • Claude 4.0 Opus
  • Claude 3.7 Sonnet
  • Claude 3.5 Haiku
  • Claude 3 Opus

DeepSeek

  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek Chat
  • DeepSeek Reasoner (mit dedizierter Reasoning-Ausgabe)

Gemini (Google)

  • Gemini 3.6 Flash
  • Gemini 3.1 Pro
  • Gemini 3.1 Flash Light
  • Gemini 3.5 Flash
  • Gemini 2.5 Pro
  • Gemini Flash Latest
  • Gemini Flash Lite Latest
  • Gemini 2.5 Flash
  • Gemini 2.5 Flash Lite
  • Gemini 2.0 Flash
  • Gemini 2.0 Flash Lite

Grok (xAI)

  • Grok 4.3
  • Grok 4.1 Schnelles Reasoning
  • Grok 4.1 Schnelles Nicht-Reasoning
  • Grok 4 Schnelles Reasoning
  • Grok 4 Schnelles Nicht-Reasoning
  • Grok Code Fast 1
  • Grok 4 0709
  • Grok 3
  • Grok 3 Mini
  • Grok 2 Vision 1212

Ollama

Lokale KI-Modelle mit vollständiger Privatsphäre und ohne API-Schlüssel ausführen:

  • Jedes Modell, das in der Ollama-Bibliothek verfügbar ist (z. B. Llama 3, Mistral, Gemma, Phi, Qwen und weitere)
  • Benutzerdefinierte und feinabgestimmte Modelle, die lokal gehostet werden

Text-zu-Sprache (TTS)

Konvertieren Sie Text in natürlich klingende Sprache mit führenden TTS-Anbietern, sowohl mit Standard- als auch mit Streaming-Optionen.

OpenAI TTS

Mehrere Sprachoptionen mit regulärer und Streaming-Unterstützung:

  • Legierung
  • Asche
  • Ballade
  • Koralle
  • Echo
  • Fabel
  • Onyx
  • Nova
  • Salbei
  • Schimmer
  • Vers

Modelle:

  • TTS-1
  • TTS-1-HD
  • GPT-4o Mini TTS

ElevenLabs TTS

Mehrere Modelle mit regulärer und Streaming-Unterstützung:

  • Eleven V3 (Neuestes Modell mit menschenähnlicher und ausdrucksstarker Sprachgenerierung, unterstützt 70+ Sprachen)
  • Eleven TTV V3 (Text-zu-Sprache-Designmodell mit menschenähnlicher und ausdrucksstarker Sprache, unterstützt 70+ Sprachen)
  • Eleven Multilingual V2 (Lebensechtestes Modell mit reichem emotionalem Ausdruck)
  • Eleven Turbo V2 (Hochwertiges, latenzarmes Modell, optimiert für Englisch)
  • Eleven Turbo V2.5 (Hochwertiges, latenzarmes Modell mit mehrsprachiger Unterstützung)
  • Eleven Flash V2 (Extrem schnelles Modell, optimiert für Echtzeitanwendungen auf Englisch)
  • Eleven Flash V2.5 (Extrem schnelles Modell, optimiert für Echtzeitanwendungen mit mehrsprachiger Unterstützung)
  • Eleven Monolingual V1

Google Cloud TTS

Hochwertige neuronale Stimmen mit umfassender Sprachunterstützung:

  • Neural2-Stimmen
  • Studio-Stimmen
  • Wavenet-Stimmen
  • Standard-Stimmen
  • Unterstützung für benutzerdefinierte Stimmen
  • Mehrere Sprachen und Gebietsschemata
  • SSML-Unterstützung für detaillierte Steuerung

Azure TTS

Microsofts kognitiver Sprachdienst mit umfangreichen Stimmoptionen

  • Neurale Stimmen in mehreren Sprachen
  • Sprechstile und Emotionen
  • Unterstützung benutzerdefinierter Stimmen
  • SSML-Markup-Unterstützung

Hauptmerkmale

  • Plattformübergreifende Kompatibilität (Windows, Mac, Android, iOS, Linux, Meta Quest und mehr)
  • Unterstützung für mehrere KI- und TTS-Anbieter
  • Lokale Modellunterstützung über Ollama (kein API-Schlüssel erforderlich, vollständige Privatsphäre)
  • Streaming- und Non-Streaming-Chat-Antworten
  • Streaming-TTS für Echtzeit-Audiosynthese und -verarbeitung
  • Unterstützung für Reasoning-Modelle mit separaten Reasoning- und Inhaltsausgaben (DeepSeek, Grok)
  • Hochwertige Sprachsynthese mit minimaler Latenz
  • Einfache Integration mit Unreal Engine Blueprints und C++
  • Flexible Konfigurationsoptionen
  • Unterstützung für über 70 Sprachen mit ElevenLabs V3-Modellen
  • Auflistung und Erkennung von Stimmen für Google Cloud und Azure TTS

Voraussetzungen

Um das Plugin zu verwenden, benötigen Sie API-Zugangsdaten von einem der unterstützten Anbieter:

Für die Audioverarbeitung können Sie Ihre eigene Lösung implementieren oder das Runtime Audio Importer Plugin verwenden, das Audiodaten in verschiedenen Formaten (MP3, WAV, FLAC, OGG VORBIS, OGG OPUS, BINK, RAW (PCM)) importieren kann. Weitere Informationen finden Sie hier.

Zusätzliche Ressourcen

Join our Discord
online · support