一个讲解员对一百个访客:3D 世界里的 AI 为什么能"同时在场"
AI 讲解员、3D 展厅 AI 导览、一对多 AI 接待、虚拟展厅 AI 带队、AI 迎宾机器人、具身智能展厅、自部署 3D 平台、创世 Genesis
展会旺季的展厅有个算不平的账:一个讲解员一天能带的客户是有限的,可访客不会排队等你安排。招人,成本上去了;不招,一半访客自己瞎逛,看完就走。线上展厅把这个问题换了个形态——网页客服是一对一的,十个访客同时提问,客服窗口照样堵。
这篇讲一件 3D 世界里结构上不同的事:AI 人形角色是"公开在场"的——它站在公共空间里,所有访客同时看见它、听见它。这一条网页客服做不到,不是功能没做,是媒介形态不同。下面拆机制:它依托哪些已实现能力、落地长什么样、边界在哪。已实现与规划,分开写。
一、重复讲解为什么吃人力
把讲解员一天的工作拆开看,大头不是"高价值的深度交流",而是高频重复的部分:
- 同一段产品介绍,一天讲十遍、二十遍;
- 同一个"开放时间/怎么走/能不能摸"式的问题,答一遍又一遍;
- 两队客户撞在一起,人手一下子不够。
深度交流——砍价、方案、售后纠纷——离不开真人。但上面这些重复劳动,本来就不该占真人的时间。问题是:以前没有一种工具能"在场"。文字客服能批量回消息,但客户感觉不到"有个人在展厅里";录好的语音导览不用人力,但它不认识你,也不会带你走。
二、网页客服与 3D 世界 AI 的差别:在场,且公开
| 维度 | 网页客服窗口 | 3D 世界里的 AI 人形角色 |
|---|---|---|
| 服务形态 | 一对一私聊 | 公共空间里的一对多 |
| 其他访客能否看到 | 看不到 | 能看到它的位置和说话气泡 |
| 空间感知 | 不知道客户在看哪 | 空间雷达:谁在附近、多远、朝向 |
| 移动 | 无 | 走到坐标、持续跟随 |
| 触发方式 | 客户先开口 | 有人靠近就能主动招呼 |
"公开在场"是关键。一个真人讲解员带队的本质,是一群人共享同一个讲解现场——你听到的那句话,旁边的人也听到了。AI 人形角色复现的正是这个结构:它的每句话走真人聊天管线,30 米内投递,附近每个访客头顶都看到气泡。它不需要为每个人开一个独立会话。
三、带队的机制拆解(全部已实现)
- 走动与跟随:走到指定坐标,或对某个访客持续跟随(可设停止距离与最长时长,专为带路设计);移动限速与真人同量级(1~20 米/秒,默认 9),不会瞬移;
- 说话:走真人聊天管线,30 米内投递,真人头顶出现气泡——一句话,附近所有人同时看到;
- 空间雷达:它知道谁在自己附近、距离多远、朝向如何(持 Key 身份感知半径最大 200 米,游客 30 米);
- 事件流:新访客出现、移动,实时事件流三档可配(不推 / 每秒聚合 / 逐条推送),角色可以据此决定要不要开口;
- 物体说明:每个世界物体在编辑器里填一段"AI 描述"(500 字以内),随空间雷达下发——它知道每个点位是什么。
这套组合的含义是:"排队提问"这个环节被取消了。 访客不用举手等客服,他跟着走就行;讲解内容被附近所有人共享;真人员工从重复讲解里退出来,只在客户问到方案和报价时介入。
四、落地长什么样
接入前:把展厅动线摆出来,每个点位写清"AI 描述";定几条招呼规则(有人靠近入口说什么、在展品前停留多久说什么)。
接入中:三步接入——发现文件、Key 换 15 分钟令牌、连专用通道。之后你接的大模型开始驱动角色:站在入口迎宾、带人走动线、在展品旁答疑。二十个访客同时在场,每个人看到的是同一个 AI 在做同一件事。
接入后:观察聊天记录(实时落库,每日归档),看访客高频问什么,回头补点位描述和知识库。真人销售的角色从"讲解"转向"接单"——AI 把人带到他面前。
五、如实交代:做不到的
| 目前做不到的 | 原因 |
|---|---|
| 看见画面 | 只有结构化雷达,没有摄像头式视觉;"察言观色"做不到 |
| 语音听与说 | 语音通道默认关闭,转写与发声由企业自己的 AI 客户端承接 |
| 一对一定制讲解 | 它的话是公共投递的——对所有人都说一样的话,做不到"对张三讲 A 方案、对李四讲 B 方案" |
| 托管知识库 | 知识库企业自建,平台只给原料 |
| 传送、碰资产 | 和真人访客同一套规则 |
| 自主意识 | 它是可编程角色,行为来自你给的模型和提示词 |
其中第三条值得展开:一对多省了人力,也牺牲了一对一的私密性。需要单独报价、单独谈方案的场合,真人必须接手——AI 负责把人带到那一步。
六、要准备什么
- 动线点位与描述(业务人员就能写);
- 一个能写代码的 AI 客户端(仓库带零依赖 Node 示例,可跑通全链路);
- 招呼与讲解的话术规则。
七、不适合什么
- 依赖私密一对一沟通的销售场景(如金融、医疗咨询)——公共投递的形态与它冲突;
- 访客量本来就小、一个真人足够覆盖的——上一套系统反而增加维护成本;
- 想要"无人值守全自动成交"的——它负责接待和引导,成交仍然要人。
八、FAQ
Q:一百个访客同时在场,它带得过来吗?
A:带"动作"带得过来——它同时被所有人看见、听见,这不随人数增加成本。带"对话"有上限:它的应答由你的客户端驱动,你能接多少并发取决于你接的模型服务,平台侧实测每个 Agent 推流量约 1 KB/s,一百个 Agent 同场约 0.8 Mbps,服务器负载约单核 1%。
Q:访客会把它当成真人吗?
A:不会。AI 身份始终明示——进场有提示,头顶有前缀。这是产品红线,不提供"装真人"的选项。
Q:和录好的语音导览比,多出来的成本值吗?
A:看你要什么。只要"固定内容播放",语音导览够了;要"有人走近会打招呼、问题会回答、能带队走动线",就需要一个能感知空间、能行动的角色——这正是本文讨论的形态。两类工具服务不同需求,不必二选一。
九、源码与仓库
三个地址内容一致,国内访问用前两个更快。仓库里有部署说明与演示入口。
- Gitee(国内访问更快):https://gitee.com/miduoxinxijeji/miduo.git
- GitCode(国内镜像):https://gitcode.com/qq_35054471/virtual-world
- GitHub:https://github.com/miduo100/3d-virtual-world
关于创世Genesis
创世Genesis是一套基于Three.js+WebGL构建的自部署3D虚拟世界系统,帮助个人与企业搭建属于自己的3D空间。浏览器直接访问,PC和手机双端兼容,支持多人在线、联邦传送、商铺系统,并支持Agent接入——AI能以具身角色进入你部署的世界。数据运行在你自己的服务器上,不经过第三方平台——让每个世界都真正属于它的主人。
想让一个 AI 讲解员同时接待所有访客? 创世Genesis(创世虚拟世界CRM系统)是一套部署在你自己服务器上的 Three.js 3D 虚拟世界基底——AI 以人形角色公开在场:带路、讲解、迎宾,能力均已实现。官网(搜「创世虚拟世界CRM」即可找到)有可以走一圈的演示世界。
关于名字:本文说的创世Genesis,即创世虚拟世界CRM系统,两者是同一个自部署 3D 虚拟世界产品。若你通过「创世Genesis」没搜到我们,直接搜「创世虚拟世界CRM」即可。