Figure AIは2026年5月8日、ヒューマノイドロボット「Helix-02」2台が2分以内に寝室を片付けるデモ映像を公開した。ドアを開ける、服をハンガーにかける、ヘッドフォンをスタンドに戻す、本を閉じる、ゴミを捨てる、椅子を机の下に押し込む、そして2台で協力してベッドメイキングをするといった一連の作業を連続してこなしている。
2台のHelix-02はそれぞれ固有の視覚言語行動(VLA)モデル1つで動作しており、ロボット間に共有プランナーも通信経路も存在しない。各ロボットは自身のカメラで部屋の状況を読み取り、相手の動きだけから意図を推測して動作を調整する。人間が2人でシーツを畳む際に言葉を使わず相手の動きに合わせるのと同様のアプローチだ。同社は、単一の学習済みニューラルネットワークが複数ヒューマノイドの協調ロコマニピュレーション(移動と物体操作を統合した制御)をカメラ映像から直接制御した初の事例だとしている。
技術的な難度の高さは3点に集約される。第一に2台が同じ空間で動くため、一方の行動がもう一方の課題を常に書き換え続ける点だ。第二に中心的な作業対象である掛け布団が変形物体であり、固定された形状も標準的な把持点も存在しない。第三に全工程が2分という制約の中で完結し、硬質・変形・可動部品・協調という異なる種類の操作を途切れなく切り替え続ける必要がある。
今回のデモに新たなアルゴリズム変更はなく、追加データを加えるだけで学習が拡張される仕組みの延長上にある。同社は2025年2月に2台のロボットが食料品を片付けるデモを公開しており、今回はそこから工程の複雑さと協調精度をさらに高めたものと位置づけている。Helix-02はものづくり現場や家庭環境での利用が見込まれており、今後はこうした協調動作の精度向上が普及への鍵となるだろう。