هاب پژوهشی
مقالات مرجع مسیر یادگیری، با خلاصهی ساختاریافته و گراف استنادی دوطرفه.
2 مقاله
2017arXiv preprint arXiv:1707.02286 (presented at NeurIPS 2017)
Emergence of Locomotion Behaviours in Rich Environments
Nicolas Heess، Koray Kavukcuoglu، Jay Lemay، Srinivasan Sriram، Darren King، David Silver
یافته: نشان داده شد که سیاستهای آموزشدیده با RL میتوانند رفتارهای متنوعی مانند راهرفتن، دویدن، پرش و حتی جهش در محیطهای مختلف را بهطور خودکار یاد بگیرند.
2004International Journal of Humanoid Robotics, vol. 1, no. 1, pp. 157-173, DOI: 10.1142/S0219843604000083
Zero-moment point – thirty five years of its life
Miomir Vukobratović، Branislav Borovac
یافته: ZMP بهعنوان معیاری ساده و مؤثر برای پایداری ایستا و پویا، به یکی از ارکان اصلی کنترل رباتهای دوپا تبدیل شده است و بسیاری از الگوریتمهای موفق بر پایهی آن طراحی شدهاند.