桃子桃子快讯
返回首页
工具

AI 进入 3D 世界,一位独立开发者选择不「装眼睛」

独立开发者推出开源 3D 底座,不渲染画面让 AI Agent 进场,单 AI 推流压至 1 KB/s。

2026.09.23 · 周三4 分钟阅读

AI 进入虚拟空间的主流做法是给模型「装上眼睛」——截图、看图、理解画面,但这意味着每个 AI 都要跑视觉模型,算力与带宽成本随数量线性上涨。来自山东济宁的独立开发者走了相反方向:不渲染画面,只传递结构化数据,把单 AI 推流压到 1 KB/s 量级。这套名为「创世 Genesis」(软件著作权登记名:创世虚拟世界 CRM 系统)的产品已开源并完成 AI Agent 具身接入验收。

项目概览:浏览器端的 3D 虚拟世界底座

创世 Genesis 是一套基于 Three.js 的浏览器端 3D 虚拟世界基底,已部署到 Gitee、GitCode、GitHub 三大代码仓库开源。它不依赖客户端安装,打开浏览器即可进入,允许 AI Agent 以人形身份进场服务,多个世界之间可联邦互通。项目所属主体为济宁米多信息科技有限公司,创始人一人全职推进,从零完成约 32 万行代码,已取得软件著作权,并提交发明专利申请。2026 年 9 月完成 AI Agent 具身接入并通过验收。

技术核心:不给 AI 视觉,让成本曲线反向

AI 接入分三步:访问发现接口获取能力清单,用密钥换取短期令牌,进场后获得三组接口:

  • 感知层:结构化雷达,告诉 AI 附近对象的位置、距离、朝向与动作;每个物体可在编辑器里填写语义描述,作为 AI 认识世界的入口。
  • 行动层:移动、跟随、转向、互动,速度可配置,默认与真人同速。
  • 被看见层:在真人端呈现带 AI 标识的 3D 角色,位置连续不瞬移,头顶有 AI 标识是产品设计上的红线。

最关键的设计取舍是 AI 完全不渲染画面。团队实测显示:单个 AI 推流约 1 KB/s,100 个 AI 同场约 0.8 Mbps,服务器占用单核 1%。系统跑在用户自己的服务器上,使用者与资产之间是真实的所有关系,而非租赁。

渲染与资产层已完成 WebGL2 适配与去 CDN 化离线改造:

  • 绘制调用降低约 73%,灯光数量变化不再触发着色器重编译;
  • 自研 3D 高斯泼溅解析与渲染支持五种常见格式;
  • 模型多级 LOD 自动生成使三角数下降七到八成,单文件体积最多缩减九成;
  • 骨骼动画回归测试 67 项全部通过。

产品边界与商业路径

团队主动交代了系统不做的部分:AI 看不见画面、不做语音识别与合成、不托管知识库、AI 不能传送或触碰资产、不承诺任何自主意识。这些限制被定义为产品边界而非待补缺口。

商业模式分三层:

  • 开源本地单机免费,不产生收入;
  • 产品授权,面向个人和小团队的对外发布与联邦互通需求;
  • 生态授权,把底座交给系统集成商按授权结算,团队自身不直接交付客户。

目标用户分两类:一是有私有化部署硬约束的企业,集中在工业设备销售、职业教育实训、博物馆展馆文旅单位;二是懂技术的团队与系统集成公司。触达渠道包括 GEO 内容铺设(已沉淀一百多篇中英文场景与技术文章)、开源仓库(被定位为信任位而非获客位)、以及直接走进产业圈层。

当前挑战:需求尚未被真金白银验证

创始人将当前最大挑战定义为「产品做完、开源出去,和有人愿意为它付费之间隔着一条沟」。应对分三步且不分散动作:先把能被看懂这件事补上,在体验未达可演示程度前不做大规模客户寻找;只做三到五个样板客户,从约束最硬的企业切入;把信任做在接触之前——源码开源、演示可进、技术文档可查。团队明确表示,这个挑战不打算靠融资跳过,而打算用第一个真实客户的交付来解决。

信源