シリーズ: AI とともにコードを学ぶ

現実世界であなたのAIをスーパーチャージする

どのアシスタントでも宿ることができる1つの空間ランタイム。

あなたのAIが宿る身体 グラスの熱設計に合わせて構築された、AIネイティブな空間ランタイム MCP 2012年以来5件の特許 18msのモーション・トゥ・フォトン サブミリ単位のアンカリング マルチベンダーMCP
モデルが手に取るツールではない。モデルが生きる身体だ。

Unityはあなたのモデルが手に取るツールだ。RakuAIはあなたのAIが宿る身体だ——10年以上前にこの瞬間を見越していた特許に支えられた、スマートグラス向けに構築された空間ランタイム。

この土曜日の朝、コーヒーを飲み終える前に、3つのベクトルが私のところに収束してきた。

Unityがちょうどネイティブ MCPを出荷した。スマートグラスのハードウェアは今や本当に人々の顔の上にあり、スライドデッキの中の話ではない。そして私が話をしてきたLLMラボはどこも同じものを求めている。ベンダーごとのカスタム統合なしに、彼らのモデルが本番環境で、毎フレーム駆動できる、型付けされた契約を通じて空間機能を公開するランタイムだ。

2025年に私が構築を始めたこのエンジンは、10年以上前に私が出願を手伝った特許の上に立っており、ついに自分自身が何であるかを表す名前を得た。それは、あなたのAIが現実世界に宿るランタイムだ。モデルが手に取るツールではない。モデルが生きる身体だ。

この投稿は、それを裏付けとともに正直に書き留めたものだ。

セクション1. 特許ポートフォリオ

5件の付与済み米国特許、優先出願日は2012年7月。それらは公開されており、検索可能であり、私のものだ。

  • US9210358B2、Entertainment Console。2015年12月付与。
  • US9654613B2、Arena Gaming。2017年5月付与。
  • US9781244B2、Smart Eyeglasses。2017年10月付与。
  • US10027361B2、Point-of-Service。2018年7月付与。
  • US10432772B2、Eyeglasses、21のクレーム。

これらをまとめて読むと、描かれているのは一つのシステムだ。デュアルモード無線。重い処理が頭部から離れた場所に存在する、スマートグラス+コンピュートホストのアーキテクチャ。ホストからディスプレイへのレンダーオフロード。同じ物理空間にいる複数の装着者間でのマルチプレイヤーワールド状態の同期。エンコードされたビデオではなく、シーンの差分としてのワールドストリーミング。

この優先日が重要だ。2012年7月。それはMeta Ray-Bansより、Xreal Airより、Android XRより、現在の形のLLMラボが存在するようになるより何年も前だ。出願書類にあるアーキテクチャは、業界が今まさに収束しつつあるアーキテクチャだ。私たちはこの分野を追いかけているのではない。私たち自身に追いついているのだ。

私が特許を前面に出すのは、それが議論に勝つからではない。それが、真剣なパートナーが2回目のミーティングで最もよく尋ねる質問、「あなたたちは実際どれくらい前からこれを考えていたのか」に答えてくれるからだ。正直な答えは2つの数字だ。特許は2012年に遡り、このエンジンは2025年から活発に構築が続いている。古いIP、新しい実行。

セクション2. なぜグラスには異なるランタイムが必要なのか

スマートグラスの制約は、コンソール、スマートフォン、PCの制約ではない。それらのどれかの小型版として扱えば、20分でオーバーヒートするプロダクトを出荷することになる。

私たちが設計目標としているいくつかの数字。

  • 18msのモーション・トゥ・フォトンのレイテンシ目標。 ピークのフレームレートではなく、予測可能なレイテンシ。ジッターのある90 FPSは、安定した60 FPSより悪く感じられる。
  • 3つの熱モード。 パフォーマンス、バランス、低電力。ランタイムは自分が今どのモードにいるかを把握し、フレームごとのパイプラインコストを調整する。モデルも、リソースを要求する際にそれを把握している。
  • スマートフォンをコンピュートとし、グラスをディスプレイとする。 ホストが力仕事を担う。ディスプレイはデュアルモードリンク上の薄いクライアントだ。それが特許が記述しているトポロジーだ。
  • Wi-Fi 7に加えて光学式デュアルモードリンク。 ワールドの差分のための帯域幅。予測されたポーズのためのレイテンシ予算。
  • 40センチメートルでの0.5〜0.8ミリメートルの空間精度、カルマンフィルタ処理済み。 サブミリ単位のアンカリングこそが、仮想の面を本物の面のように感じさせるものだ。もしあなたが仮想のパネル上で書道をしたことがあるなら、1mmのジッターと0.5mmのジッターの違いが分かるだろう。それは、書くことと殴り書きすることの違いだ。
  • 71関節の全身トラッキング。滞留を伴う視線追跡。2〜4倍のゲインを持つフォビエイテッドレンダリング。 この熱設計の枠の中では、フォビエーションはオプションではない。それは、収まるレンダー予算と収まらない予算の違いだ。

これを代替手段と比較してみてほしい。Unityは60 FPSのPCとコンソールのターゲットを中心に設計された汎用エンジンだ。UnrealはVRファーストだが、それが前提とするVRは、200ワットの熱設計予算を持つタワー内のRTX 4090だ。どちらも優れたエンジンだ。しかしどちらも、人の顔の上にある5ワットの熱設計の枠のために設計されたものではない。

これは軽視ではない。カテゴリーの違いだ。

セクション3. なぜAIにはそのために構築されたランタイムが必要なのか

私は1月にAI as Nervous System, Not AI as Factoryという投稿を書いた。その主張は、2026年に自らをAIネイティブと呼ぶほとんどのエンジンは、既存のパイプラインにチャットパネルをボルト留めしたに過ぎない、というものだった。モデルが成果物を生成する。成果物がディスクに着地する。ランタイムがその成果物を読み込む。モデルは二度とランタイムに話しかけない。

それが工場のパターンだ。それは本物であり、有用であり、実際に出荷されている。しかしそれは、空間コンピューティングが必要としているものではない。

神経系のパターンは、モデルを毎フレームのループの中に置く。観察が入り、意図が出て、ワールドが応答し、繰り返す。モデルはコンテンツのベンダーではない。シミュレーションの参加者だ。

ランタイムが公開する6つのMCPツールが、これが起きる表面だ。

  • load_world_model(adapter_name, config)
  • ingest_frame(adapter_name, frame_data, frame_index, timestamp)
  • get_scene_state(include_physics, include_transforms)
  • set_render_target(target_type, config)
  • start_simulation(tick_rate, max_duration, realtime)
  • get_metrics()

6つのツール、stdioトランスポート、デフォルト拒否のパーミッション、完全な監査ログ。Model Context Protocolを話せるどんなモデルでも、その契約を通じてランタイムを駆動できる。Claude。ChatGPT。Gemini。Copilot。次に何が出てきても。

設計としてマルチベンダー対応なのは、ランタイムが反対側にどのモデルがいるかについて何の意見も持たないからだ。契約が境界だ。ランタイムは物理演算、衝突判定、スコアリング、マルチプレイヤーの状態について権限を持ち続ける。モデルは意図を提供する。どちらの側も、6つのツールを通じてしか相手のことを知らなくてよい。

それが、神経系のパターンを出荷可能なコードにしたときの姿だ。

セクション4. RakuAI対Unity、公平に言えば

Unity Native MCPは最近出荷され、その評判は好意的だ。それが何であり、何でないかについて明確にしておきたい。両方が同時に真実でありうると思うからだ。

Unity MCPは設計時のシーン操作だ。エージェントは開発者がオブジェクトを配置し、コンポーネントを設定し、レベルを構築するのを助ける。それは人間+エディタのループのための生産性層だ。それは実際の対象者にとって実際の勝利だ。

RakuAI MCPは実行時のワールドモデル・オーケストレーションだ。エージェントは毎フレーム、ループの中にいて、ワールドの次の状態に寄与し、その一方でランタイムが物理演算・衝突判定・レンダリングを強制する。それは2026年3月時点で本番稼働しているものであり、設計時でもエディタ支援でもない。

異なるカテゴリー。どちらも有効だ。私が口にするようになった要約版はこうだ。

Unityはあなたのモデルが手に取るツールだ。RakuAIはあなたのモデルが宿る身体だ。

もしあなたが賢くなっていくエディタが欲しいなら、Unity MCPは魅力的で、試してみるべきだ。もしあなたが、あなたのAIがメガネのペアの上で生きる場所を与えるランタイムが欲しいなら、それは異なる問題だ。それを可能にする特許は10年以上前に出願され、私たちは2025年からそのエンジンを構築し続けている。

セクション5. なぜ今この話をしているのか

ポジショニングにおいてタイミングは重要であり、私たちのタイミングについて正直でありたい。

スマートグラスのハードウェアパートナーは、2026年と2027年にランタイムを選定する。その決定は一度下されれば10年間生き続ける。もし今その会話の中にいなければ、まったくその中に入れないことになる。

LLMラボは、どの空間プラットフォームと統合するかを決めつつある。初期の統合がデフォルトを決める。デフォルトは粘着性がある。

Unityが MCPを出荷したことは、このカテゴリーを検証した。私たちは何年も「モデルは型付けされた契約を通じてランタイムを駆動すべきだ」と言い続けてきた。300億ドル規模の競合が同じことを言っている今、聞き入れられやすくなった。

特許ポートフォリオは私たちにIPの滑走路を与えてくれる。特許は付与済みであり、優先日は確固としており、それらがカバーするアーキテクチャは業界が収束しつつあるアーキテクチャだ。

そして2025年からの1年間、頭を下げて構築を続けた結果、実際に準備の整ったランタイムが生まれた。MCPサーバーは本物だ。アダプタは着地しつつある。熱設計の枠は守られている。レイテンシ目標は達成されている。サブミリ単位のアンカリングは機能している。18個のDLLはLinux上でグリーンだ。100パーセントのテスト通過率は3か月間維持されている。

今こそ旗を立てるべき瞬間だ。

セクション6. 次に来るもの

具体的な作業を、確実にやり遂げるために正直に名指しする。

  • エンドツーエンドの本物のアダプタ。 Runway。Veo。パートナー提供のもの。スタブはディスパッチ経路を証明した。次の一手は、1つの本物のアダプタの背後にある1つの本物のモデルを、エンドツーエンドで公開デモすることだ。
  • 本番デプロイのハーネス。 サービステンプレート、環境変数設定、ヘルスチェックエンドポイント、優雅なシャットダウン、コンテナパッケージング。華やかではない。必要だ。
  • マルチプロバイダのフォールバック。 プライマリのアダプタが遅いか利用不可のとき、サーバーはセカンダリにルーティングする。形はシンプルだ。テストこそが本当の仕事になるだろう。
  • アダプタ・バウンティプログラム。 一つのアダプタが出荷されたら、契約を公開し、エコシステムにもっと多くのアダプタを書くよう招待する。私たちの仕事は「すべてのモデルを統合する」ことではなく、「実装をレビューする」ことになる。
  • 両側でのパートナーシップの会話。 一方にハードウェアパートナー、もう一方にモデルラボ。ランタイムはその両者の間にあるものだ。それは10年以上前に特許が用意した立ち位置であり、このエンジンは2025年からそれに見合う実力をつけてきた。

締めくくり

あなたのAIが現実世界に宿るランタイム。10年以上前に特許が見越していたカテゴリーであり、このエンジンは2025年からそこへ向けて構築を続けてきた。土曜日の朝、私たちはそれに名前を得た。

もしあなたがモデルラボ、グラスハードウェアの会社、あるいは2027年に空間体験を出荷したいスタジオにいるなら、契約は準備ができており、裏付けは公開されている。次に読むべき3つのリンク。

土曜日。コーヒーを飲み終えた。エンジンに戻ろう。

あなたのAIに現実世界で生きる場所を与える

契約は準備ができており、裏付けは公開されている。RakuAIは、グラスの熱設計に合わせて構築されたマルチベンダーの空間ランタイムだ——LLMメーカーとハードウェアの会社が共に構築するプラットフォーム。

← すべての記事