Runtime AI Chatbot Integrator

将AI聊天机器人和文本转语音服务集成到Unreal Engine项目中。支持主流提供商 包括OpenAI、Claude、DeepSeek、Gemini、Grok、Ollama、ElevenLabs、Google Cloud和Azure - 并完整支持Blueprint和C++。

UE 5.0 – 5.8
Blueprints 和 C++
支持所有平台
9个AI提供商

工作原理

该插件提供统一的API,通过HTTPS与外部AI提供商通信。发送对话历史并接收流式或完整响应 - 同时支持聊天和TTS - 全部可通过Blueprint或C++实现。

1

注册API Token

在启动时一次性为一个或多个受支持的提供商提供凭据

2

发送请求

从Blueprint或C++传递对话历史、模型名称和参数

3

流式或完整

接收实时 token 分块,或等待完整响应——两种模式均受支持

4

对输出执行操作

绑定到结果委托,并将文本或音频输入到您的游戏逻辑中

对话提供商

六个提供商,覆盖大型语言模型的全部范围——从云端托管的领先模型到本地运行的开源替代方案。

OpenAI

GPT-4o、GPT-5、O1、O3,以及最新的推理和多模态模型。

Claude (Anthropic)

Claude Opus、Sonnet 和 Haiku——包括最新的 Claude 5 系列。

DeepSeek

DeepSeek Chat 和 DeepSeek Reasoner,通过单独的委托暴露显式推理输出。

Gemini (Google) 和 Grok (xAI)

Gemini 2.5 Pro / Flash 和 Grok 3 / 4——包括 Grok 的推理变体。

Ollama(本地)

Ollama 库中的任何模型——Llama、Mistral、Gemma、Qwen 等等。无需 API 密钥。

文本转语音提供商

四个企业级 TTS 提供商,拥有丰富的语音库、语言覆盖和流式支持。

OpenAI TTS

自然语音(Alloy、Nova、Shimmer 等),支持流式播放和 TTS-1-HD 质量。

ElevenLabs

富有表现力、高保真的语音合成,支持 70 多种语言,采用 Eleven V3 和 Turbo 模型。

Google Cloud 和 Azure

来自 Google Cloud TTS 的 Neural 和 Studio 语音,以及 Azure 神经语音,支持情感和 SSML 样式。两者均包含编程式语音发现。

平台支持

Windows
Mac
Linux
Android
iOS
Meta Quest
PlayStation
Xbox
Nintendo Switch

全功能 AI 集成

除了基本的请求/响应之外,该插件还提供流式传输、推理输出、请求取消、 语音发现以及完整的错误处理——所有这些都可以通过 Blueprints 或 C++ 访问。

标准与流式对话

两种对话模式:等待完整响应,或实时接收生成的 token 分块。所有对话提供商均支持这两种模式。

标准与流式 TTS

将 AI 生成的文本转换为语音,可在单个响应中获得完整音频,或实时流式传输音频块,以便立即播放更长的输出。

高级推理输出

访问那些公开显式推理轨迹的模型——DeepSeek Reasoner 和 Grok 推理模型。推理与最终内容通过独立的委托传递。

可取消的请求

随时取消任何进行中的请求——对于需要在生成中途中断并重新启动的响应式应用来说至关重要。

语音发现

在运行时以编程方式查询 Google Cloud 和 Azure TTS 的可用语音。按语言和区域设置筛选,以在游戏中动态选择语音。

错误处理

每个请求都会返回详细的错误状态和消息信息。从 Blueprint 或 C++ 优雅地处理提供商错误、网络故障和速率限制。

Blueprint 示例 - 与 OpenAI 的流式对话

流式对话蓝图示例

试用演示

一个 Windows 演示版可供您亲身体验该插件的功能。该演示 涵盖 AI 对话、文本转语音和多提供商切换 - 同时提供完整的 Blueprint 源码项目供参考。

多提供商展示

并排测试不同提供商的对话和 TTS

流式和非流式模式

使用实时自定义输入比较两种响应模式

包含 Blueprint 源码

演示项目中包含完整的 Blueprint 实现,供参考使用

视频教程

插件生态系统

Runtime AI Chatbot Integrator 是 Georgy Dev 插件套件的 AI 智能层 - 将其与语音识别、离线 TTS 和口型同步相结合,构建完整的语音驱动 AI 角色管线。

Runtime Audio Importer

在运行时处理和播放 TTS 音频输出。是处理来自任何 TTS 提供商的流式音频数据的重要搭档。

了解更多

Runtime MetaHuman Lip Sync

直接利用 AI 生成的语音输出驱动 MetaHuman 和自定义角色的实时口型同步。

了解更多

Runtime Speech Recognizer

由 Whisper 驱动的离线语音转文本 - 将玩家的语音转换为文本,并直接输入 AI 聊天机器人。

了解更多

Runtime Text To Speech

完全离线的语音合成,拥有 2800+ 种音色。可补充云 TTS 提供商,适用于离线或对隐私敏感的场景。

了解更多

Runtime Local LLM

使用设备端 LLM 离线生成对话,然后 通过 合成的语音驱动口型同步,以实现完全离线的角色交互。

了解更多

文档与支持

全面的文档涵盖所有提供商、对话模式、TTS 工作流程、推理 模型输出、语音发现和错误处理 - 并始终附有 Blueprint 和 C++ 示例。

完整文档

所有功能的分步指南,包含 Blueprint 和 C++ 示例

社区与支持

活跃的 Discord 社区,提供开发者支持

定制开发

定制集成或功能开发 - [email protected]

Blueprint 示例 - 发送对话请求

发送OpenAI聊天请求蓝图示例

准备好为您的项目添加 AI 对话了吗?

可在 Fab 上获取,适用于 UE 5.0 – 5.8。支持 9 家 AI 提供商、流式响应、推理模型,以及覆盖 70+ 语言的企业级 TTS。