为你的 LiveKit Agent 加上实时 3D 数字人。

保留现有语音技术栈,通过 Spatius 官方插件加入同步、端侧渲染的实时 3D 数字人。

01

克隆仓库并进入 Quickstart 目录

LiveKit

克隆 Spatius Avatar Demo 仓库,然后进入 LiveKit Agents Quickstart 目录。

命令
git clone https://github.com/spatius-ai/spatius-avatar-demo.git
cd spatius-avatar-demo/platform-integrations/livekit-agents-demo/livekit-agent-quickstart
02

创建环境变量文件

LiveKit

复制两份模板并打开,然后在 backend/.env 与 frontend/.env 中填入 Spatius、LiveKit 和 Google AI Studio 凭证。

命令
cp backend/.env.example backend/.env
cp frontend/.env.example frontend/.env
03

安装依赖

LiveKit

安装前后端依赖。后端会将 livekit-agents、livekit-plugins-google 与 livekit-plugins-spatius 锁定为匹配版本。

命令
# backend
cd backend
uv sync
# frontend
cd ../frontend
pnpm install
04

启动完整链路(3 个终端)

LiveKit

分别启动 Token Server、LiveKit Agent Worker 和前端。打开 localhost:3000,依次点击 Connect 与 Enable Mic。

命令
# Terminal 1: token server
cd spatius-avatar-demo/platform-integrations/livekit-agents-demo/livekit-agent-quickstart/backend
uv run token_server.py
# Terminal 2: LiveKit agent worker
cd spatius-avatar-demo/platform-integrations/livekit-agents-demo/livekit-agent-quickstart/backend
uv run agent.py dev
# Terminal 3: frontend
cd spatius-avatar-demo/platform-integrations/livekit-agents-demo/livekit-agent-quickstart/frontend
pnpm dev

只加形象,不换大脑。

LiveKit Agents 继续编排对话;Spatius 把语音转成同步 motion data,再由 AvatarKit 在本地渲染。

点击节点查看详情
LiveKit Agents 集成架构由你管理由 Spatius 管理LiveKit Agents WorkerAgentSessionSTT / LLM / TTSVAD / turns / toolsSpatius Pluginlivekit-plugins-spatiusMotionServerLiveKit roomRTC AdapterLiveKit providerAvatarKit SDKclient rendereruser audioAvatar
Spatius 发布的是同步音频与 motion data,而不是渲染完成的数字人视频,因此 Web 客户端必须使用 AvatarKit RTC。

传输驱动数据,在本地渲染。

LiveKit 传输同步音频与 motion data;AvatarKit 再在用户设备上把数据渲染成透明、可交互的 3D 数字人。

01 · LIVEKIT ROOM

音频与动作,始终同步。

LiveKit 同步传输 Agent 语音与 Spatius motion data。

AUDIO TRACKMOTION DATA
02 · BROWSER

画面在浏览器中渲染。

AvatarKit RTC 在本地渲染数字人。

支持所有主流浏览器
01

轻量传输

LiveKit 传输同步音频和 motion data,而不是持续传输渲染后的视频流。

02

为交互而生

透明 3DGS 数字人层可以自然嵌入你的界面、前景和背景。

03

随客户端扩展

渲染工作在浏览器完成,减少逐会话服务端视频渲染带来的 GPU 负担。

04

更经济的运行成本

motion-first 架构避免为每个会话单独渲染并推送一条视频流。

对比端侧与云端渲染架构

ChickyTutor 无需重做语音产品,也能加入真实陪伴感。

LiveKit 继续处理实时语音会话,Spatius 则加入可见的数字人层,让语言练习更像面对面交流。

阅读客户案例
ChickyTutor with a Spatius real-time avatar

LiveKit 集成常见问题。

Spatius 会替换我现有的 LiveKit 语音链路吗?+

不会。VAD、STT、LLM、TTS、轮次管理和业务逻辑仍由你的 LiveKit Agent 负责。Spatius 只把 Agent 的语音转成 motion data,并在 Web 客户端渲染数字人。

为什么普通 LiveKit 视频渲染器会显示黑屏?+

数字人轨道承载的是同步 motion data,而不是已经渲染好的视频帧。请使用 @spatius/avatarkit-rtc 与 AvatarKit 在本地解码和渲染。

目前支持哪些平台?+

LiveKit Agents 集成的客户端路径目前面向 Web。iOS 和 Android 请通过其他集成路径使用 Spatius 原生 SDK。

凭证应该放在哪里?+

Spatius 和 LiveKit 的密钥必须保存在服务端,不要把 SPATIUS_API_KEY 或 LIVEKIT_API_SECRET 写进浏览器代码。