跳到主要内容

为你的 LiveKit Agent 加上实时形象。

保留现有语音技术栈,通过 Spatius 官方插件加入同步、端侧渲染的实时 3D 数字人。

保留 LLM保留 TTS端侧渲染

运行 Quickstart。

spatius@livekit — bash

只加形象,不换大脑。

现有 LiveKit Agent 保持控制;Spatius 添加同步动作,LiveKit 负责传输,AvatarKit 在客户端渲染最终数字人。

01 · 保留

对话逻辑

现有 LiveKit Agent 继续处理 STT、LLM、TTS、工具与轮次管理。

现有 LIVEKIT AGENT
02 · 添加

同步动作

官方 Spatius 插件把 Agent 语音转成实时面部动作。

官方 SPATIUS 插件
03 · 传输

音频 + 动作

LiveKit 在同一房间内同步传输音频与轻量 motion data。

LIVEKIT ROOM
04 · 渲染

最终画面,本地生成

AvatarKit RTC 在客户端渲染数字人,而不是持续传输云端渲染视频。

AVATARKIT RTC · 端侧

Spatius 发布同步的音频与动作数据,而非完成的数字人视频。Web 客户端必须使用 AvatarKit RTC。

传输驱动数据,在本地渲染。

LiveKit 传输同步音频与 motion data;AvatarKit 再在用户设备上把数据渲染成透明、可交互的 3D 数字人。

比较端侧与云端渲染架构
01 · LIVEKIT ROOM

音频与动作,始终同步。

LiveKit 同步传输 Agent 语音与 Spatius motion data。

02 · BROWSER

画面在浏览器中渲染。

AvatarKit RTC 在本地渲染数字人。

轻量传输

LiveKit 传输同步音频和 motion data,而不是持续传输渲染后的视频流。

为交互而生

透明 3DGS 数字人层可以自然嵌入你的界面、前景和背景。

随客户端扩展

渲染工作在浏览器完成,减少逐会话服务端视频渲染带来的 GPU 负担。

更经济的运行成本

motion-first 架构避免为每个会话单独渲染并推送一条视频流。

SayMei 通过 Spatius 让 AI 普通话练习更有面对面感。

LiveKit 继续处理实时语音会话,Spatius 则加入可见的数字人层,让语言练习更像面对面交流。

阅读客户案例
SayMei AI 普通话 tutor 与 Spatius 实时数字人

回答阻碍接入的关键问题。

四个实用答案,帮助你从架构理解进入实施细节。

Spatius 会替换我现有的 LiveKit 语音链路吗?+

不会。VAD、STT、LLM、TTS、工具和业务逻辑仍保留在 LiveKit Agent 中;Spatius 只加入同步动作与端侧渲染。

为什么普通 LiveKit 视频渲染器会显示黑屏?+

数字人轨道传输的是同步动作数据,而不是完成的视频帧。AvatarKit RTC 会解码轨道并在本地渲染数字人。

目前支持哪些平台?+

LiveKit Agents 集成目前面向 Web;iOS 和 Android 请通过相应集成路径使用 Spatius 原生 SDK。

凭证应该放在哪里?+

Spatius 和 LiveKit 密钥必须保存在服务端,不要把 SPATIUS_API_KEY 或 LIVEKIT_API_SECRET 写进浏览器代码。

你的 LiveKit Agent 已经有了声音。
现在,给它一个形象。

几分钟内加入同步、端侧渲染的实时数字人。

免费开始