Saltar al contenido principal

Resumen

Runtime AI Chatbot Integrator Documentation

Runtime AI Chatbot Integrator es un plugin multiplataforma para Unreal Engine que permite la integración fluida de chatbots de IA y servicios de texto a voz directamente en tus proyectos. El plugin admite múltiples proveedores líderes de IA y ofrece interacciones de chat flexibles con modos de respuesta tanto en streaming como no streaming, así como conversión de texto a voz de alta calidad con capacidades de streaming.

Funciones compatibles

Chat de Texto a Texto

Integrar capacidades conversacionales impulsadas por AI con múltiples proveedores líderes.

OpenAI

  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • GPT-5.6 Luna
  • GPT-5.5
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.4 Nano
  • GPT-5.3
  • GPT-5.2
  • GPT-5.1
  • GPT-5
  • GPT-5 Mini
  • GPT-5 Nano
  • GPT-4-1
  • GPT-4-1 Mini
  • GPT-4-1 Nano
  • GPT-4o
  • GPT-4o Mini
  • GPT-4
  • GPT-4 Turbo
  • GPT-4-32k
  • GPT-3.5 Turbo
  • GPT-3.5 Turbo 16k
  • ChatGPT-4o Latest
  • O1
  • O1 Pro
  • O3
  • O3 Mini
  • O4 Mini

Claude (Anthropic)

  • Claude 5 Opus
  • Claude 5 Sonnet
  • Claude 5 Fable
  • Claude 4.8 Opus
  • Claude 4.7 Opus
  • Claude 4.6 Opus
  • Claude 4.6 Sonnet
  • Claude 4.5 Haiku
  • Claude 4.5 Sonnet
  • Claude 4.5 Opus
  • Claude 4.1 Opus
  • Claude 4 Sonnet
  • Claude 4.0 Opus
  • Claude 3.7 Sonnet
  • Claude 3.5 Haiku
  • Claude 3 Opus

DeepSeek

  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek Chat
  • DeepSeek Reasoner (con salida de razonamiento dedicada)

Gemini (Google)

  • Gemini 3.6 Flash
  • Gemini 3.1 Pro
  • Gemini 3.1 Flash Light
  • Gemini 3.5 Flash
  • Gemini 2.5 Pro
  • Gemini Flash Latest
  • Gemini Flash Lite Latest
  • Gemini 2.5 Flash
  • Gemini 2.5 Flash Lite
  • Gemini 2.0 Flash
  • Gemini 2.0 Flash Lite

Grok (xAI)

  • Grok 4.3
  • Grok 4.1 Fast Reasoning
  • Grok 4.1 Fast Non-Reasoning
  • Grok 4 Fast Reasoning
  • Grok 4 Fast Non-Reasoning
  • Grok Code Fast 1
  • Grok 4 0709
  • Grok 3
  • Grok 3 Mini
  • Grok 2 Vision 1212

Ollama

Ejecuta modelos de IA locales con privacidad total y sin necesidad de clave API:

  • Cualquier modelo disponible en la biblioteca de Ollama (por ejemplo, Llama 3, Mistral, Gemma, Phi, Qwen y más)
  • Modelos personalizados y ajustados finamente alojados localmente

Texto a Voz (TTS)

Convierte texto en voz natural utilizando proveedores líderes de TTS, con opciones tanto estándar como de streaming.

OpenAI TTS

Múltiples opciones de voz con soporte normal y de streaming

  • Aleación
  • Ceniza
  • Balada
  • Coral
  • Eco
  • Fábula
  • Ónice
  • Nova
  • Salvia
  • Brillo
  • Verso

Modelos:

  • TTS-1
  • TTS-1-HD
  • GPT-4o Mini TTS

ElevenLabs TTS

Múltiples modelos con soporte estándar y streaming:

  • Eleven V3 (Modelo más reciente con generación de voz humana y expresiva, admite más de 70 idiomas)
  • Eleven TTV V3 (Modelo de diseño de texto a voz con voz humana y expresiva, admite más de 70 idiomas)
  • Eleven Multilingual V2 (Modelo más realista con rica expresión emocional)
  • Eleven Turbo V2 (Modelo de alta calidad y baja latencia optimizado para inglés)
  • Eleven Turbo V2.5 (Modelo de alta calidad y baja latencia con soporte multilingüe)
  • Eleven Flash V2 (Modelo ultrarrápido optimizado para uso en tiempo real en inglés)
  • Eleven Flash V2.5 (Modelo ultrarrápido optimizado para uso en tiempo real con soporte multilingüe)
  • Eleven Monolingual V1

Google Cloud TTS

Voces neuronales de alta calidad con amplio soporte de idiomas:

  • Voces Neural2
  • Voces Studio
  • Voces Wavenet
  • Voces estándar
  • Soporte de voz personalizada
  • Múltiples idiomas y configuraciones regionales
  • Compatibilidad con SSML para control detallado

Azure TTS

El servicio de voz cognitivo de Microsoft con amplias opciones de voz:

  • Voces neuronales en múltiples idiomas
  • Estilos de voz y emociones
  • Soporte de voz personalizada
  • Soporte de marcado SSML

Características clave

  • Compatibilidad multiplataforma (Windows, Mac, Android, iOS, Linux, Meta Quest y más)
  • Compatibilidad con múltiples proveedores de IA y TTS
  • Compatibilidad con modelos locales mediante Ollama (sin necesidad de clave API, privacidad total)
  • Respuestas de chat en streaming y no streaming
  • TTS en streaming para síntesis y procesamiento de audio en tiempo real
  • Compatibilidad con modelos de razonamiento con salidas separadas de razonamiento y contenido (DeepSeek, Grok)
  • Síntesis de voz de alta calidad con latencia mínima
  • Integración sencilla con Blueprints de Unreal Engine y C++
  • Opciones de configuración flexibles
  • Compatibilidad con más de 70 idiomas con modelos ElevenLabs V3
  • Listado y descubrimiento de voces para Google Cloud y Azure TTS

Requisitos previos

Para usar el plugin, necesitarás credenciales de acceso API de uno de los proveedores compatibles:

Para el procesamiento de audio, puede implementar su propia solución o usar el complemento Runtime Audio Importer, que puede importar datos de audio en varios formatos (MP3, WAV, FLAC, OGG VORBIS, OGG OPUS, BINK, RAW (PCM)). Para más información, vea aquí.

Recursos adicionales

Join our Discord
online · support