کنترل حرکت ربات دوپا یکی از مسئلههای چالشبرانگیز در زمینه کنترل و رباتیک میباشد. روشهای کلاسیک مدل-محور برای حل این مسئله به طراحی مسیر و همچنین یک سیکل تکرارشونده به نام گیت برای پاهای ربات میپردازند، سپس یک کنترلکننده برای ربات طراحی میشود. هر چند روشهای کلاسیک مدل-محور ربات را مجبور به تکرار یک الگو به صورت دقیق میکند، ولی معمولا نیاز به فرضهای سادهساز و مدل دقیق دارد. روشهای یادگیری تقویتی عمیق که الهام گرفته از مغز انسان است یک رویکرد مقاوم و تطبیقپذیر جهت کنترل و تصمیمگیری ارائه میدهد.

