Runtime AI Chatbot Integrator

将 AI 聊天机器人和文本转语音服务集成到 Unreal Engine 项目中。支持领先的服务商, 包括 OpenAI、Claude、DeepSeek、Gemini、Grok、Ollama、ElevenLabs、Google Cloud 和 Azure —— 并提供完整的 Blueprint 和 C++ 支持。

UE 5.0 – 5.8
Blueprints 和 C++
支持所有平台
9 家 AI 服务商

工作原理

该插件提供统一的 API,用于通过 HTTPS 与外部 AI 服务商通信。发送对话历史记录,并接收流式或完整的响应 —— 无论是聊天还是 TTS —— 全部可从 Blueprint 或 C++ 中完成。

1

注册 API Token

在启动时一次性提供一个或多个受支持服务商的凭据

2

发送请求

从 Blueprint 或 C++ 传入对话历史记录、模型名称和参数

3

流式传输或完整响应

接收实时 token 数据块,或等待完整响应——两种模式均支持

4

对输出执行操作

绑定到结果委托,并将文本或音频接入你的游戏逻辑

对话提供商

六家提供商,覆盖大语言模型的完整谱系——从云端托管的前沿模型到本地运行的开源替代方案。

OpenAI

GPT-4o、GPT-5、O1、O3 以及最新的推理与多模态模型。

Claude(Anthropic)

Claude Opus、Sonnet 和 Haiku——包括最新的 Claude 5 系列。

DeepSeek

DeepSeek Chat 和 DeepSeek Reasoner,通过独立的委托暴露显式推理输出。

Gemini(Google)和 Grok(xAI)

Gemini 2.5 Pro / Flash 和 Grok 3 / 4——包括 Grok 的推理变体。

Ollama(本地)

Ollama 库中的任意模型——Llama、Mistral、Gemma、Qwen 等等。无需 API 密钥。

文本转语音提供商

四家企业级 TTS 提供商,拥有丰富的语音库、广泛的语言覆盖范围以及流式传输支持。

OpenAI TTS

自然语音(Alloy、Nova、Shimmer 等),支持流式传输,并具备 TTS-1-HD 音质。

ElevenLabs

覆盖 90 多种语言的表现力强、高保真语音合成,支持 Eleven V4、Turbo 等模型。

Google Cloud 和 Azure

来自 Google Cloud TTS 的 Neural 和 Studio 语音,以及支持情感和 SSML 风格的 Azure 神经网络语音。两者均包含程序化语音发现功能。

平台支持

Windows
Mac
Linux
Android
iOS
Meta Quest
PlayStation
Xbox
Nintendo Switch

全功能 AI 集成

除了基本的请求/响应之外,该插件还提供流式传输、推理输出、请求取消、 语音发现以及完整的错误处理——所有这些都可以从 Blueprints 或 C++ 访问。

标准与流式对话

两种对话模式:等待完整响应,或在其生成时实时接收 token 块。所有对话提供商均支持这两种模式。

标准与流式 TTS

将 AI 生成的文本转换为语音,可在单个响应中获得完整音频,也可实时流式传输音频块,以便立即播放较长的输出。

高级推理输出

从公开推理轨迹的模型(DeepSeek Reasoner 和 Grok 推理模型)中获取显式推理轨迹。推理内容与最终内容通过单独的委托传递。

可取消的请求

随时取消任何进行中的请求——对于需要在流式生成中途中断并重新开始的响应式应用来说至关重要。

语音发现

在运行时以编程方式查询 Google Cloud 和 Azure TTS 中可用的语音。按语言和区域设置进行筛选,以便在游戏内动态选择语音。

错误处理

每个请求都会返回详细的错误状态和消息信息。可从 Blueprint 或 C++ 优雅地处理提供商错误、网络故障和速率限制。

Blueprint 示例 - 与 OpenAI 的流式对话

流式对话 Blueprint 示例

试用演示

提供 Windows 演示版,让您亲身体验该插件的各项功能。该演示 涵盖 AI 对话、文本转语音和多提供商切换 - 同时还提供完整的 Blueprint 源码项目供参考。

多提供商展示

并排测试不同提供商的对话和 TTS

流式与非流式模式

使用实时自定义输入对比两种响应模式

包含 Blueprint 源码

演示项目中提供完整的 Blueprint 实现以供参考

视频教程

插件生态系统

Runtime AI Chatbot Integrator 是 Georgy Dev 插件套件的 AI 智能层 - 将其与语音识别、离线 TTS 和口型同步相结合,即可构建完整的语音驱动 AI 角色管线。

Runtime Audio Importer

在运行时处理和播放 TTS 音频输出。是处理来自任意 TTS 提供商的流式音频数据的重要搭档。

了解更多

Runtime MetaHuman Lip Sync

直接根据 AI 生成的语音输出,驱动 MetaHuman 和自定义角色的实时口型同步。

了解更多

Runtime Speech Recognizer

由 Whisper 驱动的离线语音转文本 - 将玩家语音转换为文本,并直接输入 AI 聊天机器人。

了解更多

Runtime Text To Speech

完全离线的语音合成,拥有 2800+ 种声音。可补充云端 TTS 提供商,适用于离线或对隐私敏感的场景。

了解更多

Runtime Local LLM

使用设备端 LLM 离线生成对话,然后 从 合成语音驱动口型同步,实现完全离线的角色交互。

了解更多

文档与支持

全面的文档涵盖所有提供商、对话模式、TTS 工作流、推理 模型输出、语音发现和错误处理 - 并附有 Blueprint 和 C++ 示例。

完整文档

所有功能的分步指南,附 Blueprint 和 C++ 示例

社区与支持

活跃的 Discord 社区,提供开发者支持

定制开发

量身定制的集成或功能开发 - [email protected]

Blueprint 示例 - 发送对话请求

发送 OpenAI 聊天请求的 Blueprint 示例

准备好为你的项目添加 AI 对话了吗?

已在 Fab 上架,支持 UE 5.0 – 5.8。支持 9 家 AI 提供商、流式响应、推理模型,以及支持 90 多种语言的企业级 TTS。