物理模擬

MuJoCo + PyTorch

從腳本式機器人控制,進階到行為克隆、視覺語言動作模型、PPO 與跨領域強化學習。

MuJoCo + PyTorch 示範

學習目標

  • 控制 robosuite 環境並設計 Gymnasium reward
  • 收集專家軌跡並訓練行為克隆策略
  • 使用 LeRobotDataset 微調 SmolVLA
  • 訓練 PPO locomotion 並探索跨領域策略轉移

模擬與行為克隆

本節內容

建立環境,並讓策略從示範資料中學習。

強化學習

本節內容

訓練策略並探索不同機器人形態與任務之間的轉移。

返回實體 AI 總覽