Asymptotically Stable Adaptive–Optimal Control Algorithm With Saturating Actuators and Relaxed Persistence of Excitation

Kyriakos G.vamvoudakis; Márcio Fantini Miranda; Joao p. Hespanha

doi:10.1109/TNNLS.2015.2487972

Asymptotically Stable Adaptive–Optimal Control Algorithm With Saturating Actuators and Relaxed Persistence of Excitation

Data

2015

Autor(es)

Kyriakos G.vamvoudakis

Márcio Fantini Miranda

Joao p. Hespanha

Editor

Universidade Federal de Minas Gerais

Tipo

Artigo de periódico

Título alternativo

Algoritmo de controle adaptativo-ótimo assintoticamente estável com atuadores de saturação e persistência relaxada de excitação

Resumo

This paper proposes a control algorithm based on adaptive dynamic programming to solve the infinite-horizon optimal control problem for known deterministic nonlinear systems with saturating actuators and nonquadratic cost functionals. The algorithm is based on an actor/critic framework, where a critic neural network (NN) is used to learn the optimal cost, and an actor NN is used to learn the optimal control policy. The adaptive control nature of the algorithm requires a persistence of excitation condition to be a priori validated, but this can be relaxed using previously stored data concurrently with current data in the update of the critic NN. A robustifying control term is added to the controller to eliminate the effect of residual errors, leading to the asymptotically stability of the closed-loop system. Simulation results show the effectiveness of the proposed approach for a controlled Van der Pol oscillator and also for a power system plant.

Abstract

Este artigo propõe um algoritmo de controle baseado em programação dinâmica adaptativa para resolver o problema de controle ótimo de horizonte infinito para sistemas não lineares determinísticos conhecidos com atuadores saturantes e funcionais de custo não quadráticos. O algoritmo é baseado em um framework ator/crítico, onde uma rede neural crítica (NN) é usada para aprender o custo ótimo, e um ator NN é usado para aprender a política de controle ótima. A natureza de controle adaptativo do algoritmo requer que uma persistência da condição de excitação seja validada a priori, mas isso pode ser relaxado usando dados previamente armazenados concomitantemente com dados atuais na atualização do NN crítico. Um termo de controle robusto é adicionado ao controlador para eliminar o efeito de erros residuais, levando à estabilidade assintoticamente do sistema em malha fechada. Os resultados da simulação mostram a eficácia da abordagem proposta para um oscilador controlado de Van der Pol e também para uma planta de sistema elétrico.

Assunto

Programação dinâmica aproximada, Controle ideal, Controle robusto, Aprendizado por reforço

Palavras-chave

Approximate dynamic programming (ADP), Optimal Control, reinforcement learning, robust control

URI

https://hdl.handle.net/1843/39711

Departamento

COLTEC - COLEGIO TECNICO

Endereço externo

https://ieeexplore.ieee.org/document/7302057/keywords#keywords

Coleções

Artigo de Periódico

Página do item completo

Asymptotically Stable Adaptive–Optimal Control Algorithm With Saturating Actuators and Relaxed Persistence of Excitation

Data

Autor(es)

Título da Revista

ISSN da Revista

Título de Volume

Editor

Descrição

Tipo

Título alternativo

Primeiro orientador

Membros da banca

Resumo

Abstract

Assunto

Palavras-chave

Citação

URI

Departamento

Curso

Endereço externo

Coleções

Avaliação

Revisão

Suplementado Por

Referenciado Por