一个 3D 世界里放一百个 AI,服务器是什么状态?
AI Agent 服务器成本、3D 虚拟世界 AI 并发、AI 角色渲染成本、浏览器渲染 vs 服务端推流、虚拟世界 AI 扩展性、AI 数字人带宽、自部署 3D 世界性能、创世 Genesis
把 AI 接进 3D 世界,很多团队卡在同一个担心上:AI 一多,服务器扛不扛得住?
这个担心背后有个默认假设:AI 在 3D 世界里"出现",就意味着要渲染它、推流它,AI 翻倍、成本翻倍。但在这套架构里,实测结果和这个假设是反的。这篇讲三件事:为什么成本曲线是反的、一百个 AI 同场时的实测数字、以及这些数字没有覆盖什么——最后一部分和数字本身一样重要。
一、先说结论
AI 在这个世界里不渲染任何画面。服务器只转发它的坐标、朝向和说话文本,3D 模型由每一个访客的浏览器自己下载、自己绘制。
所以"多一个 AI"增加的负载,不是一路视频流,而是一段每秒约 1 KB 的 JSON。一百个 AI 同场,推流量约 0.8 Mbps,服务器负载约等于单核的 1%。瓶颈从来不在"让它出现在画面里",而在它背后调用的那个大模型——而那部分花多少,由你自己选模型决定。
二、成本曲线为什么是反的
常识是"AI 越像 3D 角色,成本越高"。把一个 AI 做成看得见的角色,传统思路要回答"画面从哪来":
| 思路 | 机制 | 负担落在哪 |
|---|---|---|
| 服务端渲染再推流 | AI 的画面在服务器上渲染,编码成视频推给每个访客 | 服务器算力+带宽随 AI 数量和访客数量双倍增长 |
| 访客端渲染结构化数据 | 服务器只发"它在哪、朝向哪、说了什么",每个访客的浏览器用这些数据自己画 | 服务器只承担轻量转发,AI 不吃渲染算力 |
这套系统走的是第二条路。AI 不是一路视频,是一条文字通道上的一个角色:位置数据让它被画在正确的坐标上,文本让它开口。访客越多,每个访客浏览器多画一个模型;服务器侧,每个 AI 始终只是每秒一 KB 上下。
这就是"看得见的 AI 比看不见的 AI 便宜"的机制来源——便宜的不是省了渲染,而是渲染这件事被分给了本来就要画整个世界的访客浏览器。
三、实测数字
以下是 AI Agent 通道的实测值(验收脚本可重跑):
| 指标 | 实测值 |
|---|---|
| 每个 Agent 的推流量 | 约 1 KB/s |
| 100 个 Agent 同场推流量 | 约 0.8 Mbps |
| 服务器负载 | 20 秒 0.19 核秒,约等于单核的 1% |
| 真人端观感 | 位置滞后小于 3 米,移动平滑无跳格 |
| 移动限速 | 1~20 米/秒(服务端权威,默认 9,与真人同量级) |
| 空闲退场 | 5 分钟无操作自动离开世界,不占名额 |
| 感知半径 | Key 身份最大 200 米;游客身份 30 米 |
两个设计帮了大忙:移动是服务端限速的平面移动(没有物理模拟),事件流分三档(不推 / 每秒聚合 / 逐条推送),按业务需要选档位,不必人人都逐条推。
四、这些数字没有覆盖什么
如实列出来,避免把实测值当成总成本:
- 大模型调用——AI 的"说话内容"来自你接入的模型,这部分费用与 Agent 通道无关,也往往是总成本里占比高的那一块;
- 世界本体的访客负载——真人访客的资源下载、多人同步、语音,是另一本账,不在这组数字里;
- 网络出口与存储——聊天记录落库、按日归档的存储占用;
- 高频道场景——下面的第五节。
一句话:这组数字回答的是"让一百个 AI 在场要花多少服务器",不回答"你的 AI 应用整体要花多少钱"。
五、什么情况下数字会变大
| 变量 | 影响 |
|---|---|
| 事件流选逐条推送档 | 消息频率上升,推流量随之上升;每秒聚合档是折中选择 |
| 说话频率 | 文本走通道,高频说话占用相应增加,但量级仍在 KB/s |
| 并发上限设置 | 后台可设上限,超出的连接被拒——上限定多高,决定了峰值在哪 |
| 感知半径档位 | 游客身份限 30 米,Key 身份 200 米;半径越大,雷达返回的数据越多 |
这些都是后台可配的旋钮,不是隐形成本。
六、FAQ
Q:一百个 AI 同场真的测过吗?
A:测过。数字来自验收脚本(100 Agent 同场、持续走动说话),脚本保留在项目里可重跑。需要说明的是这是通道本身的测试,不包含大模型调用的压力。
Q:100 个 AI 有什么实际用途?
A:一个直接的用途是压测容量上限;业务上的用法(多点位导览、多角色活动)由使用方编排。本文只对容量负责,不替应用场景背书。
Q:这和把 AI 做成视频流相比,差的只是成本吗?
A:不止成本。文字通道意味着 AI 的行为是结构化、可审计的——每条指令有回执、可吊销。视频流方案里,这些治理点都藏在画面后面。
Q:访客端会有感知吗?
A:访客浏览器要多下载一个角色模型并绘制它,这是正常的世界内容开销;AI 本身的行为数据(每秒约 1 KB)对访客设备不构成额外负担。
七、源码与仓库
三个地址内容一致,国内访问用前两个更快。仓库里有部署说明与演示入口。
- Gitee(国内访问更快):https://gitee.com/miduoxinxijeji/miduo.git
- GitCode(国内镜像):https://gitcode.com/qq_35054471/virtual-world
- GitHub:https://github.com/miduo100/3d-virtual-world
关于创世Genesis
创世Genesis是一套基于Three.js+WebGL构建的自部署3D虚拟世界系统,帮助个人与企业搭建属于自己的3D空间。浏览器直接访问,PC和手机双端兼容,支持多人在线、联邦传送、商铺系统,并支持Agent接入——AI能以具身角色进入你部署的世界。数据运行在你自己的服务器上,不经过第三方平台——让每个世界都真正属于它的主人。
想在自己的世界里规模化放 AI,又不想为"让它被看见"付渲染账? 创世Genesis(创世虚拟世界CRM系统)是一套部署在你自己服务器上的 Three.js 3D 虚拟世界基底——AI 不占渲染算力,每 Agent 约 1 KB/s,数字可复现。官网(搜「创世虚拟世界CRM」即可找到)有可以走一圈的演示世界。
关于名字:本文说的创世Genesis,即创世虚拟世界CRM系统,两者是同一个自部署 3D 虚拟世界产品。若你通过「创世Genesis」没搜到我们,直接搜「创世虚拟世界CRM」即可。