YouDuck.ai

61 次元の観測契約

最終更新

Microduck のすべてのポリシーは 61 次元の観測契約を共有します。歩行も転倒復帰も前転も、入力形式はまったく同じです。

これが何を可能にするか

形式が共通なので、どのポリシーもいつでもロボットを引き継げます。ランタイムは状態変換も並べ替えもせず、切り替えとは別の .onnx を読み込むことです。

直接の帰結が 2 つあります。

転倒復帰は引き継ぎを待たない。 倒れた瞬間に復帰ポリシーが介入できます。歩行ポリシーが制御を「譲る」のを待つ必要はありません。

ポリシーをモデルのように共有できる。 誰かがより良い歩行ポリシーを学習させたら、その .onnx をダウンロードして差し替えるだけで使えます。観測形式が取り決められているからです。これは Pollen Robotics が Hugging Face に買収された後の製品方向とも一致します。

シミュレーションで切り替えを予行する

uv run scripts/infer_policy.py --walking walk.onnx --standing stand.onnx \
    --sitstand sitstand.onnx --roulade roulade.onnx --new-cmd-obs

このスクリプトが予行するのは、まさに実機ランタイムのホットスワップです。

制約

共有契約は気軽に変えられません。新しい観測(ボールの位置、カメラ特徴)を足すことは、すべてのポリシーを学習し直すことを意味します。ボールキックのポリシーがボールを見ていない理由のひとつがこれです。