Pular para o conteúdo principal

Visão geral

Runtime AI Chatbot Integrator Documentation

Runtime AI Chatbot Integrator é um plugin multiplataforma para Unreal Engine que permite a integração perfeita de chatbots de IA e serviços de conversão de texto em fala diretamente em seus projetos. O plugin oferece suporte a vários provedores líderes de IA e oferece interações de chat flexíveis com modos de resposta em streaming e não streaming, além de conversão de texto em fala de alta qualidade com recursos de streaming.

Recursos compatíveis​

Chat de Texto para Texto​

Integre capacidades conversacionais com IA de vários provedores líderes.

OpenAI​

  • GPT-5.6 Sol
  • GPT-5.6 Terra
  • GPT-5.6 Luna
  • GPT-5.5
  • GPT-5.4
  • GPT-5.4 Mini
  • GPT-5.4 Nano
  • GPT-5.3
  • GPT-5.2
  • GPT-5.1
  • GPT-5
  • GPT-5 Mini
  • GPT-5 Nano
  • GPT-4-1
  • GPT-4-1 Mini
  • GPT-4-1 Nano
  • GPT-4o
  • GPT-4o Mini
  • GPT-4
  • GPT-4 Turbo
  • GPT-4-32k
  • GPT-3.5 Turbo
  • GPT-3.5 Turbo 16k
  • ChatGPT-4o Latest
  • O1
  • O1 Pro
  • O3
  • O3 Mini
  • O4 Mini

Claude (Anthropic)​

  • Claude 5.5 Opus
  • Claude 5.5 Sonnet
  • Claude 5.1 Fable
  • Claude 5 Opus
  • Claude 5 Sonnet
  • Claude 5 Fable
  • Claude 4.8 Opus
  • Claude 4.7 Opus
  • Claude 4.6 Opus
  • Claude 4.6 Sonnet
  • Claude 4.5 Haiku
  • Claude 4.5 Sonnet
  • Claude 4.5 Opus
  • Claude 4.1 Opus
  • Claude 4 Sonnet
  • Claude 4.0 Opus
  • Claude 3.7 Sonnet
  • Claude 3.5 Haiku
  • Claude 3 Opus

DeepSeek​

  • DeepSeek V4 Pro
  • DeepSeek V4 Flash
  • DeepSeek Chat
  • DeepSeek Reasoner (com saída de raciocínio dedicada)

Gemini (Google)​

  • Gemini 3.7 Flash
  • Gemini 3.6 Flash
  • Gemini 3.1 Pro
  • Gemini 3.1 Flash Light
  • Gemini 3.5 Flash
  • Gemini 2.5 Pro
  • Gemini Flash Latest
  • Gemini Flash Lite Latest
  • Gemini 2.5 Flash
  • Gemini 2.5 Flash Lite
  • Gemini 2.0 Flash
  • Gemini 2.0 Flash Lite

Grok (xAI)​

  • Grok 4.3
  • Grok 4.1 Fast Reasoning
  • Grok 4.1 Fast Non-Reasoning
  • Grok 4 Fast Reasoning
  • Grok 4 Fast Non-Reasoning
  • Grok Code Fast 1
  • Grok 4 0709
  • Grok 3
  • Grok 3 Mini
  • Grok 2 Vision 1212

Ollama​

Execute modelos de IA locais com total privacidade e sem necessidade de chave de API:

  • Qualquer modelo disponível na biblioteca do Ollama (por exemplo, Llama 3, Mistral, Gemma, Phi, Qwen e muito mais)
  • Modelos personalizados e ajustados hospedados localmente

Conversão de Texto em Fala (TTS)​

Converta texto em fala com som natural usando os principais provedores de TTS, com opções padrão e de streaming.

OpenAI TTS​

Múltiplas opções de voz com suporte regular e de streaming:

  • Liga
  • Cinza
  • Balada
  • Coral
  • Eco
  • Fábula
  • Ônix
  • Nova
  • Sálvia
  • Cintilar
  • Verso

Modelos:

  • TTS-1
  • TTS-1-HD
  • GPT-4o Mini TTS

ElevenLabs TTS​

Vários modelos com suporte regular e de streaming:

  • Eleven v4 (modelo de síntese de fala mais emocionalmente rico e expressivo da ElevenLabs, com clonagem de voz excepcional, suporte a mais de 90 idiomas e diálogo natural com vários falantes)
  • Eleven v4 Turbo (modelo de síntese de fala expressivo e em tempo real com latência ultrabaixa (~100ms mediana), clonagem de voz excepcional e suporte a mais de 90 idiomas)
  • Eleven V3 (geração de fala humanizada e expressiva, com suporte a mais de 70 idiomas)
  • Eleven TTV V3 (modelo de design de Texto para Voz com fala humanizada e expressiva, com suporte a mais de 70 idiomas)
  • Eleven Multilingual V2 (síntese de fala realista com rica expressão emocional, com suporte a 29 idiomas)
  • Eleven Turbo V2 (modelo de alta qualidade e baixa latência otimizado para inglês)
  • Eleven Turbo V2.5 (modelo de alta qualidade e baixa latência com suporte multilíngue)
  • Eleven Flash V2 (modelo ultrarrápido otimizado para uso em tempo real em inglês)
  • Eleven Flash V2.5 (modelo ultrarrápido otimizado para uso em tempo real com suporte multilíngue)
  • Eleven Monolingual V1

Google Cloud TTS​

Vozes neurais de alta qualidade com amplo suporte a idiomas:

  • Vozes Neural2
  • Vozes Studio
  • Vozes Wavenet
  • Vozes padrão
  • Suporte a voz personalizada
  • Vários idiomas e localidades
  • Suporte a SSML para controle refinado

Azure TTS​

Serviço de fala cognitiva da Microsoft com amplas opções de vozes:

  • Vozes neurais em vários idiomas
  • Estilos de voz e emoções
  • Suporte a voz personalizada
  • Suporte a marcação SSML

Principais Recursos​

  • Compatibilidade multiplataforma (Windows, Mac, Android, iOS, Linux, Meta Quest e mais)
  • Suporte para múltiplos provedores de AI e TTS
  • Suporte a modelos locais via Ollama (nenhuma chave de API necessária, privacidade total)
  • Respostas de chat em streaming e não streaming
  • TTS em streaming para síntese e processamento de áudio em tempo real
  • Suporte a modelos de raciocínio com saídas separadas de raciocínio e conteúdo (DeepSeek, Grok)
  • Síntese de voz de alta qualidade com latência mínima
  • Integração fácil com Blueprints e C++ do Unreal Engine
  • Opções de configuração flexíveis
  • Suporte a mais de 90 idiomas com modelos ElevenLabs V4
  • Listagem e descoberta de vozes para Google Cloud e Azure TTS

Pré-requisitos​

Para usar o plugin, você precisará de credenciais de acesso à API de um dos provedores suportados:

Para processamento de áudio, você pode implementar sua própria solução ou usar o plugin Runtime Audio Importer, que pode importar dados de áudio em vários formatos (MP3, WAV, FLAC, OGG VORBIS, OGG OPUS, BINK, RAW (PCM)). Para mais informações, veja aqui.

Recursos Adicionais​

Join our Discord
online · support