Rhoda AIが今回の公開とともに披露したのは「ビデオ予測制御(video prediction control)」ベースのロボットプラットフォームFutureVisionだ。ロボットが行動を実行する前にその結果を映像の形で予め予測し、予測された将来のシーンに基づいて制御信号を逆算する方式である。言語モデル中心の既存ロボットファンデーションモデルアプローチとは異なり、視覚的世界モデルを制御ループの中心に置いたという点が差別点に挙げられる。シリーズA段階で4.5億ドルという規模は従来のシリーズAの数十倍に達するもので、初期段階であっても大規模なコンピューティングとハードウェア投資が不可欠なフィジカルAI分野の資本集約的特性をそのまま見せる。