Dynamické programovanie a LQR
Dynamické programovanie efektívne rieši komplexné problémy optimalizácie systémov pomocou princípu optimality a rozkladu na menšie podproblémy. LQR je špecifický príklad, kde sa dá využiť na návrh regulátorov. Exponenciálny nárast výpočtovej náročnosti však predstavuje obmedzenie.
Prednáška siedma z kurzu Optimal and Learning-Based Control na Stanforde sa venovala fascinujúcemu svetu dynamického programovania a jeho aplikácii v Linear Quadratic Regulator (LQR) probléme. Profesor Marco Pavone nám ukázal, ako môžeme efektívne riešiť komplexné problémy optimalizácie systémov pomocou elegantných algoritmov. Cieľom bolo pochopiť princípy dynamického programovania a vidieť, ako sa dá použiť na návrh regulátorov pre rôzne systémy, od robotiky po riadenie letov.
Prečo dynamické programovanie?
Predchádzajúce prednášky sa zameriavali na metódy otvoreného riadenia (open-loop), ktoré boli relatívne jednoduché, ale menej robustné voči rušeniam a nepresnostiam modelu. Dynamické programovanie predstavuje alternatívu v podobe uzavretého riadenia (closed-loop). To znamená, že regulátor neaplikuje preddefinovanú sekvenciu ovládacích signálov, ale na základe aktuálneho stavu systému vyberá optimálny ovládací signál. Tento prístup je oveľa odolnejší voči premenlivým podmienkam a chybám v modeli.