跳到主要內容

#reinforcement-learning

1 篇

標籤
  1. 006

    把一隻機器狗搬進瀏覽器:它的走路策略只是四次矩陣乘法

    用 MuJoCo 的 WebAssembly 版和 Deep Robotics 公開的走路策略,在瀏覽器裡讓 Lite3 走起來,然後動手把它弄倒:蒙住它的感覺、推它、調壞它的馬達。

    互動#ai-agent#robotics#reinforcement-learning

    7 分鐘