系列: 与 AI 一起学编程

在现实世界中为你的 AI 加持

一个任何智能体都能栖身其中的空间运行时。

一具你的 AI 栖身其中的躯体 AI 原生空间运行时,为眼镜的热功耗包线而生 MCP 5 项专利,始于 2012 年 18 毫秒动作到成像延迟 亚毫米级锚定 多厂商 MCP
不是模型拿起来用的工具,而是模型生活在其中的一具躯体。

Unity 是你的 AI 拿起来用的工具。RakuAI 是你的 AI 栖身其中的躯体——这个为智能眼镜打造的空间运行时,背后有着十多年前就预见到这一时刻的专利支撑。

这个星期六早上,在我喝完咖啡之前,三条线索在我脑中汇聚到了一起。

Unity 刚刚发布了原生 MCP。智能眼镜硬件如今已经真正戴在人们的脸上了,而不再只是幻灯片里的概念图。而我一直在交谈的那些 LLM 实验室,想要的都是同一件事:一个能通过契约把空间能力暴露出来、供他们的模型驱动的运行时——在生产环境中,每一帧都如此,而且不需要针对每个厂商做定制集成。

我在 2025 年开始构建的这台引擎,建立在我十多年前协助申请的专利之上,如今终于有了一个能准确描述它是什么的名字。它是你的 AI 在现实世界中栖身的运行时。不是模型拿起来用的工具,而是模型生活在其中的躯体。

这篇文章就是我如实地把这一切写下来,并附上证据。

第一部分:专利资产

五项已获授权的美国专利,优先权申请日为 2012 年 7 月。它们是公开的,可检索的,属于我。

  • US9210358B2,娱乐主机。2015 年 12 月获授权。
  • US9654613B2,竞技场游戏。2017 年 5 月获授权。
  • US9781244B2,智能眼镜。2017 年 10 月获授权。
  • US10027361B2,服务点。2018 年 7 月获授权。
  • US10432772B2,眼镜,21 项权利要求。

把它们放在一起读,你会发现它们描述的是一个系统:双模无线;一种智能眼镜加计算主机的架构,重体力活都留在头部之外完成;从主机到显示端的渲染卸载;同一物理空间内多个佩戴者之间的多人世界状态同步;以场景增量而非编码视频形式进行的世界流式传输。

优先权日期很重要。2012 年 7 月,这比 Meta Ray-Bans、比 Xreal Air、比 Android XR,甚至比现今这批 LLM 实验室以其当前形态存在都要早上好几年。这些专利文件中的架构,正是整个行业现在正在趋同的架构。我们不是在追赶这个领域,我们是在追赶我们自己。

我之所以拿专利说话,并不是因为专利能赢得争论。我拿它们说话,是因为它们回答了一个认真的合作伙伴在第二次会面时最常问的问题:「你们究竟思考这件事有多久了。」诚实的答案是两个数字:专利可以追溯到 2012 年,而这台引擎自 2025 年起一直在积极构建之中。老的知识产权,新的执行力。

第二部分:为什么眼镜需要一个不一样的运行时

智能眼镜的约束条件,不同于游戏主机、手机或 PC 的约束条件。如果你把它们当作这些设备的缩小版来对待,你交付出来的产品会在二十分钟内过热。

我们设计时依据的一些数字:

  • 18 毫秒的动作到成像延迟目标。 可预测的延迟,而非峰值帧率。一个抖动的 90 FPS 体验,比一个稳定的 60 FPS 还要糟糕。
  • 三种热功耗模式。 性能模式、平衡模式、低功耗模式。运行时知道自己处于哪种模式,并按帧调整流水线开销。模型在请求资源时,也知道这一点。
  • 手机作为计算端,眼镜作为显示端。 主机是真正干活的马力所在。显示端是通过双模链路连接的瘦客户端。这正是专利文件中所描述的拓扑结构。
  • Wi-Fi 7 加光学双模链路。 带宽用于世界增量数据,延迟预算用于预测姿态。
  • 在 40 厘米距离下、经卡尔曼滤波的 0.5 到 0.8 毫米空间精度。 亚毫米级锚定,正是让一个虚拟表面感觉起来像真实表面的关键。如果你曾在一块虚拟平面上写过书法,你就知道 1 毫米抖动和 0.5 毫米抖动之间的区别。那是「书写」和「涂鸦」之间的区别。
  • 71 个关节的全身追踪。带停留检测的眼动追踪。增益 2 到 4 倍的中心凹渲染。 在这样的功耗包线下,中心凹渲染不是可选项。它是渲染预算「够用」和「不够用」之间的区别。

现在把这些和其他方案对比一下。Unity 是一个围绕 60 FPS 的 PC 和主机目标设计的通用引擎。Unreal 是 VR 优先的,但它所假设的 VR 是一台功率预算 200 瓦、装在机箱里的 RTX 4090。两者都是出色的引擎。但都不是为一个人脸上 5 瓦的热功耗包线设计的。

这不是贬低。这是品类上的差异。

第三部分:为什么 AI 需要一个为它而生的运行时

我在一月份写过一篇文章,标题是《AI 作为神经系统,而非 AI 作为工厂》。文章的论点是,2026 年大多数自称「AI 原生」的引擎,意思其实是在既有的流水线上焊了一个聊天面板。模型生产出一个产物。产物落到磁盘上。运行时加载这个产物。模型此后再也不会和运行时对话。

那是工厂模式。它是真实存在的,是有用的,是已经在交付的。但它不是空间计算真正需要的东西。

神经系统模式让模型参与到每一帧的循环之中。观察进来,意图出去,世界作出响应,如此循环。模型不是一个内容供应商,而是仿真中的一个参与者。

这个运行时暴露出的六个 MCP 工具,正是这一切发生的表面。

  • load_world_model(adapter_name, config)
  • ingest_frame(adapter_name, frame_data, frame_index, timestamp)
  • get_scene_state(include_physics, include_transforms)
  • set_render_target(target_type, config)
  • start_simulation(tick_rate, max_duration, realtime)
  • get_metrics()

六个工具,stdio 传输,默认拒绝的权限,完整的审计日志。任何会说 Model Context Protocol 的模型,都能通过这个契约驱动这个运行时。Claude、ChatGPT、Gemini、Copilot,以及未来发布的任何模型。

设计之初就是多厂商中立的,因为这个运行时对另一端接入的是哪个模型没有任何偏好。契约就是边界。运行时始终保留对物理、碰撞、计分、多人游戏状态的主导权。模型贡献的是意图。双方除了通过这六个工具之外,都不需要了解对方。

这就是神经系统模式变成可交付代码之后的样子。

第四部分:RakuAI 与 Unity 的公允对比

Unity 原生 MCP 最近发布了,反响不错。我想说清楚它是什么、不是什么,因为我认为这两点可以同时成立。

Unity MCP 是设计时的场景操控。一个智能体帮助开发者放置对象、配置组件、搭建关卡。它是「人加编辑器」这个循环的生产力层。对于它面向的真实受众来说,这是一个真正的胜利。

RakuAI MCP 是运行时的世界模型编排。智能体参与到每一帧的循环之中,为世界的下一个状态做出贡献,同时运行时强制执行物理、碰撞和渲染。这是 2026 年 3 月已经在生产环境中的东西,不是设计时的功能,也不是编辑器辅助。

不同的品类。两者都成立。我开始挂在嘴边的一句精炼说法是:

Unity 是你的 AI 拿起来用的工具。RakuAI 是你的 AI 栖身其中的躯体。

如果你想要一个变得更聪明的编辑器,Unity MCP 令人兴奋,你应该去试试。如果你想要一个能让你的 AI 在一副眼镜上有个安身之所的运行时,那是另一个问题。让这一切成为可能的专利是十多年前申请的,而我们自 2025 年起一直在构建这台引擎。

第五部分:为什么我们现在谈这个

在做定位这件事上,时机很重要,我想对我们的时机保持诚实。

智能眼镜硬件合作伙伴正在 2026 年和 2027 年选定自己的运行时。这些决定一旦做出,就会延续十年。如果你现在不在这些对话之中,你以后也不会在。

LLM 实验室正在决定要集成哪些空间平台。早期的集成会设定默认选项。而默认选项是有黏性的。

Unity 发布 MCP 验证了这个品类。多年来我们一直在说「模型应该通过一个类型化契约来驱动运行时」。现在有一个市值三百亿美元的竞争对手也在说同样的话,这个观点自然更容易被听见。

专利资产给了我们知识产权上的跑道。这些专利已获授权,优先权日期扎实,它们所覆盖的架构正是整个行业正在趋同的架构。

而自 2025 年以来一年埋头苦干的构建,产出了一个真正已经就绪的运行时。MCP 服务器是真实的。适配器正在陆续落地。热功耗包线得到了尊重。延迟目标已经达成。亚毫米级锚定能正常工作。十八个 DLL 在 Linux 上全部转绿。100% 的测试通过率已经保持了三个月。

现在正是插旗的时刻。

第六部分:接下来是什么

具体的工作,如实列出,好让它们真正被完成。

  • 端到端的真正适配器。 Runway。Veo。合作伙伴提供的模型。桩代码已经证明了调度路径可行。下一步是让一个真正的模型接入一个真正的适配器,端到端地公开演示。
  • 生产部署框架。 服务模板、环境变量配置、健康检查端点、优雅关闭、容器打包。不光鲜,但必要。
  • 多厂商回退机制。 当主适配器缓慢或不可用时,服务器路由到一个备用适配器。方案本身很直接。真正的工作量在于测试。
  • 适配器悬赏计划。 一旦某个适配器发布,就公开契约,邀请整个生态系统来编写更多适配器。我们的工作不再是「集成每一个模型」,而是变成「评审实现」。
  • 双向的合作伙伴对话。 一边是硬件合作伙伴,另一边是模型实验室。运行时就是横亘在两者之间的东西。这正是十多年前专利所奠定的位置,而这台引擎自 2025 年起一直在为此努力。

结语

这是你的 AI 在现实世界中栖身的运行时。这个品类是十多年前专利所预见到的,而这台引擎自 2025 年起一直朝着它构建。星期六早上,我们终于给它起了个名字。

如果你身处一家模型实验室、一家眼镜硬件公司,或是一家想在 2027 年交付空间体验的工作室,这份契约已经就绪,证据也是公开的。接下来值得一读的三个链接:

星期六。咖啡喝完了。回去继续做引擎。

让你的 AI 在现实世界中有个安身之所

契约已经就绪,证据也是公开的。RakuAI 是为眼镜的热功耗包线而生的多厂商空间运行时——LLM 制造者和硬件公司用来构建产品的平台。

← 所有文章