概述

Runtime AI Chatbot Integrator是一个跨平台的Unreal Engine插件,能够将AI聊天机器人和文本转语音服务无缝集成到您的项目中。该插件支持多个领先的AI服务提供商,并提供灵活的聊天交互,支持流式和非流式响应模式,以及具有流式功能的高质量文本转语音转换。
支持的功能
文本到文本聊天
集成多个领先提供商的AI驱动对话能力。
OpenAI
- GPT-5.6 Sol
- GPT-5.6 Terra
- GPT-5.6 Luna
- GPT-5.5
- GPT-5.4
- GPT-5.4 Mini
- GPT-5.4 Nano
- GPT-5.3
- GPT-5.2
- GPT-5.1
- GPT-5
- GPT-5 Mini
- GPT-5 Nano
- GPT-4-1
- GPT-4-1 Mini
- GPT-4-1 Nano
- GPT-4o
- GPT-4o Mini
- GPT-4
- GPT-4 Turbo
- GPT-4-32k
- GPT-3.5 Turbo
- GPT-3.5 Turbo 16k
- ChatGPT-4o 最新版
- O1
- O1 Pro
- O3
- O3 Mini
- O4 Mini
Claude (Anthropic)
- Claude 5 Opus
- Claude 5 Sonnet
- Claude 5 Fable
- Claude 4.8 Opus
- Claude 4.7 Opus
- Claude 4.6 Opus
- Claude 4.6 Sonnet
- Claude 4.5 Haiku
- Claude 4.5 Sonnet
- Claude 4.5 Opus
- Claude 4.1 Opus
- Claude 4 Sonnet
- Claude 4.0 Opus
- Claude 3.7 Sonnet
- Claude 3.5 Haiku
- Claude 3 Opus
DeepSeek
- DeepSeek V4 Pro
- DeepSeek V4 Flash
- DeepSeek Chat
- DeepSeek Reasoner (具有专用推理输出)
Gemini (Google)
- Gemini 3.6 Flash
- Gemini 3.1 Pro
- Gemini 3.1 Flash Light
- Gemini 3.5 Flash
- Gemini 2.5 Pro
- Gemini Flash Latest
- Gemini Flash Lite Latest
- Gemini 2.5 Flash
- Gemini 2.5 Flash Lite
- Gemini 2.0 Flash
- Gemini 2.0 Flash Lite
Grok (xAI)
- Grok 4.3
- Grok 4.1 快速推理
- Grok 4.1 快速非推理
- Grok 4 快速推理
- Grok 4 快速非推理
- Grok 代码快速 1
- Grok 4 0709
- Grok 3
- Grok 3 迷你
- Grok 2 视觉 1212
Ollama
在本地运行AI模型,完全保护隐私,无需API密钥:
- Ollama 库中可用的任何模型(例如 Llama 3、Mistral、Gemma、Phi、Qwen 等)
- 本地托管的定制和微调模型
文本转语音 (TTS)
使用领先的TTS提供商将文本转换为自然流畅的语音,提供标准和流式两种选项。
OpenAI TTS
多种语音选项,支持常规和流式传输:
- 合金
- 灰烬
- 歌谣
- 珊瑚
- 回声
- 寓言
- 缟玛瑙
- 新星
- 智者
- 微光
- 诗篇
模型:
- TTS-1
- TTS-1-HD
- GPT-4o Mini TTS
ElevenLabs TTS
多个支持常规和流式传输的模型:
- Eleven V3(最新模型,具备拟人且富有表现力的语音生成能力,支持70多种语言)
- Eleven TTV V3(文本转语音设计模型,具备拟人且富有表现力的语音,支持70多种语言)
- Eleven Multilingual V2(最逼真的模型,具有丰富的情感表达)
- Eleven Turbo V2(高质量、低延迟模型,针对英语优化)
- Eleven Turbo V2.5(高质量、低延迟模型,支持多语言)
- Eleven Flash V2(超快模型,针对英语实时使用优化)
- Eleven Flash V2.5(超快模型,针对实时使用优化,支持多语言)
- Eleven Monolingual V1
Google Cloud TTS
高质量神经语音,支持多种语言:
- Neural2 语音
- Studio 语音
- WaveNet 语音
- 标准语音
- 自定义语音支持
- 多种语言和区域设置
- SSML 支持精细控制
Azure TTS
微软的认知语音服务,具有广泛的语音选项:
- 跨多种语言的神经语音
- 语音风格与情感
- 自定义语音支持
- SSML 标记支持
主要功能
- 跨平台兼容性(Windows、Mac、Android、iOS、Linux、Meta Quest等)
- 支持多种AI和TTS提供商
- 通过Ollama支持本地模型(无需API密钥,完全隐私保护)
- 流式和非流式聊天响应
- 用于实时音频合成与处理的流式TTS
- 推理模型支持,提供分离的推理和内容输出(DeepSeek、Grok)
- 高质量语音合成,低延迟
- 与Unreal Engine蓝图和C++轻松集成
- 灵活的配置选项
- 支持70+种语言,使用ElevenLabs V3模型
- 针对Google Cloud和Azure TTS的语音列表与发现
先决条件
要使用该插件,你需要从支持的提供商之一获取API访问凭证:
- OpenAI API
- Anthropic API
- DeepSeek API
- Google Gemini API
- xAI Grok API
- ElevenLabs API
- Google Cloud Text-to-Speech API
- Azure Cognitive Services Speech API
- Ollama (本地,无需API密钥)
对于音频处理,您可以实现自己的解决方案,或使用 Runtime Audio Importer 插件,该插件可以导入多种格式的音频数据(MP3、WAV、FLAC、OGG VORBIS、OGG OPUS、BINK、RAW (PCM))。更多信息,请查看 这里。
其他资源
- 在 Fab 上获取
- 产品网站
- 下载演示版 (Windows)
- 下载演示版源文件 (UE 5.6+)
- 视频演示项目指南
- 插件支持与定制开发:[email protected](为团队和组织量身定制的解决方案)
Join our Discord
online · support