Conception D'algorithmes de Commande Par Apprentissage Itératif Pour Les Systèmes Perturbés
Conception D'algorithmes de Commande Par Apprentissage Itératif Pour Les Systèmes Perturbés
Koukiolfa43@[Link]
Abstract : ce travail porte sur la commande robuste par dans une mémoire d'un ordinateur. Un algorithme met
apprentissage itératif des systèmes 2D répétitifs linéaires avec itérativement à jour le signal d’entrée à l’aide de l'erreur
présences des perturbations afin de suivre un modèle de entre la réponse réelle et la réponse souhaitée de
référence. Les lois de commande proposées sont itérativement
l'actionneur. Dans ce brevet, les applications de la loi de
misent à jour pour garantir la stabilité du système. La
commande par apprentissage sont discutées pour les unités
convergence monotonique des approches proposées sont
d'entraînement électriques et les actionneurs pneumatiques.
présentées en termes des inégalités matricielles LMI.
Ceci est clairement une implémentation de l’algorithme de
Mots clés : commande par apprentissage itératif, commande type ILC dans un sens général. La première contribution
robuste, inégalités matricielles, systèmes 2D, convergence académique de l’ILC est le papier publié par [2]. Par la
monotonique. suite les articles de [3], et [4] ont été indépendamment
publiés, en décrivant une méthode pourrait itérativement
I. INTRODUCTION
compenser les erreurs des modèles et annuler les effets des
L’approche de commande par apprentissage itératif est une perturbations.
méthode qui a connu une croissance de popularité
Le domaine de la robotique industrielle représente le
importante au cours de dernières décennies. Elle signifie la
domaine le plus adéquat pour l’implémentation de l’ILC, où
répétition de faire opérer un objectif donné d’un système et
les séquences répétitives apparaissent dans nombreuses
la possibilité d’améliorer l’entrée de commande en se
applications. Une grande partie des premiers travaux est
basant sur les informations de l’opération précédente. En
consacrée à la convergence des algorithmes de l’ILC et
effet, c’est une méthode de commande récursive en ligne
l’analyse de robustesse. Une attention particulière est
qui se base sur moins de calculs et nécessite moins
dirigée vers les systèmes linéaires et vers une classe
d’informations sur la dynamique du système. L’idée est
spéciale des systèmes non linéaires représentés par des
d’appliquer un algorithme simple et répétitif sur un procédé
modèles dynamiques des robots, tels que par exemple dans
inconnu jusqu’à ce que la poursuite parfaite soit achevée.
[5] et [6]. A la fin de l’année 1990, l'accent a été mis sur la
L’ILC a été énoncée au début de l’année 1970. Une conception et la performance des algorithmes. Un exemple
application pour l’obtention d’un brevet aux États-Unis typique est le livre de Bien et Xu [7], qui couvre à la fois
porte sur « la commande par apprentissage itératif des l'analyse, la conception et les applications. Une autre
actionneurs pour les systèmes électriques » a été acceptée référence a été présentée par Longman [8], qui discute
en 1971 [1]. L'idée était de stocker un signal de commande aussi les aspects pratiques de conception et de performance.
Copyright IPCO-2017
ISSN 2356-5608
Dans [9], la formalisation de la différence entre la Le modèle de référence à suivre est donné par la
robustesse et la performance a été discutée. D’autres représentation d’état suivante :
problèmes ouverts sont également présents pour dériver des
méthodes générales de l’ILC ayant des signaux de référence xd t Axd t Bud t
(2)
yd t Cxd t
similaires et pas identiques [9], et pour concevoir des
algorithmes assez simples, robustes et avec des bonnes
performances pour une utilisation industrielle [9]. Alors, le
Nous cherchons, dans ce travail, une commande par
domaine de l’ILC est encore en croissance et il y a
beaucoup de problèmes théoriques aussi bien que pratiques apprentissage itératif capable de commander le système (1)
à étudier.
afin de suivre le modèle (2) tout en considérant que les états
Au cours des vingt dernières années, un grand nombre initiaux de deux systèmes ne doivent pas forcément être
d'algorithmes de commande ILC ont été développés. L’ILC
est devenue un cadre englobant de nombreuses variétés égaux.
d'approches de commande. Chacun a ses propres mérites en
ek t et eyk t
termes de performance telles que la convergence, la
robustesse, la vitesse d’apprentissage, ou la pertinence pour Nous définissons comme suit :
les procédés spéciaux. Des contributions qui ont fournit une
aperçu de l’ILC ces dernières années sont [10], [11], [12]
et [13]. ek t xd t xk t
eyk t yd t yk t
(3)
Les processus répétitifs représentent une classe distincte des
systèmes linéaires bidimensionnels (2-D) dont la
Notre but est de trouver une commande mixte qui permet
propagation de l'information s’effectue dans deux directions
dans un premier lieu d’annuler l’effet des perturbations et
indépendantes [14]. Une forme populaire en littérature pour
dans un second lieu de réduire l’erreur sur la trajectoire
les systèmes répétitifs 2-D est introduite par [15][16] pour
pendant un nombre fini d’itérations. La commande
un système linéaire discret sans perturbations.
proposée se compose de deux parties, la première partie est
II. Formulation du problème
une commande robuste et la seconde est une commande par
Considérons un système dynamique linéaire représenté par apprentissage itératif qui garantit une convergence
les équations d’état suivantes: monotonique.
Copyright IPCO-2017
ISSN 2356-5608
Nous définissons la variable d’état suivante qui sera utilisée Nous définissons le système suivant :
k 1 t Ak 1 t Buk 1 t B0eyk t B11 k 1 t
ultérieurement dans l’analyse et la synthèse de la
commande robuste à apprentissage itératif :
eyk 1 t Ck 1 t Duk 1 t D0eyk t B12 k 1 t
t t (12)
k 1 t xk 1 t dt xk t dt (5)
0 0 Avec :
A A, B B, C CA, D CB, B0 0, B11 H ,
III. RILC DE TYPE P
B12 CH et D0 I .
La loi de commande robuste à apprentissage itératif de type La fonction de Lyapunov introduite pour le système définit
P s’écrit sous la forme de l’équation (4) où : par l’équation (12) est décrite par l’équation (12).
V k , t V1 k , t V2 k , t kT1 t P1k 1 t
v1,k t ud t K rob ek t
eTyk t P2 eyk t
(13)
(6)
v2,k t v2,k 1 t K Piter eyk 1 t
Le système linéaire décrit par l’équation (12) est stable si et
Avec K rob et K Piter représentent respectivement des seulement s’il existe deux matrices P1 et P2 définies
w2 w2 *
ey k eyk dt (10)
0 * * *
(15)
0 3 4 0 I * * * 0
(CH )T HT 0 0 2 I * *
L’erreur sur la sortie pendant l’itération k+1est donnée par : 0 0 w2 0 0 I *
0 I
0 0 I 0 0
Copyright IPCO-2017
ISSN 2356-5608
1 w1 (CA)T N1T (CB)T éliminant les deux premières lignes et les deux premières
colonnes et la preuve est complète.
2 w1 AT Aw1 N1T BT BN1
IV. RILC DE TYPE D
3 K Piter
T
(CB)T
4 K Piter
T
BT La loi de commande robuste à apprentissage itératif de type
D s’écrit sous la forme de l’équation (4) où :
e yk t e yk t Théorème 2: Soit la loi de commande robuste et à
0
(16)
eyk t eyk t
apprentissage itératif décrit par (22) est appliquée à un
t t système répétitif linéaire décrit par le modèle d’état (12).
k 1 k 1
Alors, le système 2D est stable tout au long de l’itération et
Aˆ T P PAˆ1 Aˆ 2T SAˆ 2 LT L M T M R PBˆ1 Aˆ 2T SBˆ 2 ayant une norme H∞ bornée 0 s’il existe les matrices
1
Bˆ1T P Bˆ 2T SAˆ 2 2 I Bˆ 2T SBˆ 2 Y1 0, Y2 0, Z1 et Z2 tel que la LMI décrit par (23)
(17)
est vérifiée :
Y2 (*) (*) (*) (*)
A BK rob B0 BK Piter P4 0 0
(*)
Aˆ1 0 0 0 S 0 P3 0 (18) 1 2 (*) (*)
0 0 0 0 0 P2 3 Z BT
2
T
Y2 (*) (*) 0 (23)
CH 2 I
T
HT 0 (*)
P1 0 0 0 I
0 0 0 0 Y2 0
0 0
Aˆ 2 0 0 0 P 0 (19)
C - DK rob D0 DK Piter 0 0 0 Avec :
(20)
Y1 P11 , Y2 P21 , Y3 P31 , Z1 K rob P11 et
Copyright IPCO-2017
ISSN 2356-5608
T L’élaboration de la loi de commande passe par la
k 1 t k 1 t
e yk t e yk t 0 (24) détermination des gains K rob , K Piter et K Diter .
k 1 t k 1 t
La loi de commande appliquée au système (12) est donnée
Avec : par l’équation suivante :
Aˆ1T P PAˆ1 Aˆ 2T SAˆ 2 LT L R PBˆ1 Aˆ2T SBˆ2 uk 1 t Krobk 1 t KPiter eyk t KDiter eyk t (30)
Bˆ1T P Bˆ 2T SAˆ 2 2 I Bˆ 2T SBˆ 2
Dans le but d’achever les performances désirées, la loi de
(25)
commande proposée est appliquée au système en vérifiant
le théorème suivant.
ˆ A BK rob B0 BK Diter P 0 ˆ B11
A1 S 3 B1 0
0 0 0 P2
Théorème 3
(26)
Soit la loi de commande robuste et à apprentissage itératif
décrit par (30) est appliquée à un système répétitif linéaire
0 0 0
Aˆ2 B̂ (27) décrit par le modèle d’état (12). Alors, le système 2D est
C - DK rob D0 DK Diter 2 B12
stable tout au long de l’itération et ayant une norme H∞
P 0 0 0
P 1 ,R et L 0 I (28) bornée 0 s’il existe les matrices w1 0, w2 0,
0 0 0 P2
N1 et N2 tel que la LMI décrit par (31) est vérifiée :
En appliquant le lemme de Schur modifié deux fois w2 * * * * * *
2 *
successives à l’équation (25) ensuite en remplaçant les 1 * * * *
équations (26), (27) et (28) dans le résultat puis en 3 N B T T
w2 * * * *
2
(31)
4 I * 0
T T
K PiterB 0 * *
multipliant le résultat à droite et à gauche par
(CH )T H T
0 0 2 I * *
T diag{P31 , P21 , P11 , P21 , I , I } enfin en remplaçant 0 0 w2 0 0 I *
0 I
les variables par ses expressions et la preuve est complète. 0 0 I 0 0
2,k
v t v2, k 1 t K e
Piter yk 1 t K
e
Diter yk 1 t
Preuve
Avec K rob , K Piter et K Diter représentent respectivement
Le système est stable si et seulement si :
des matrices de gains robuste et proportionnel-dérivé à
k 1 t k 1 t
T
apprentissage itératif.
e yk t e yk t (32)
0
eyk t eyk t
t t
k 1 k 1
Copyright IPCO-2017
ISSN 2356-5608
Avec: dernier couple résistif est présent comme la somme Cl+Cr.
Cl est la partie de ce couple généré par le frein à poudre. Cr
Aˆ T P PAˆ1 Aˆ 2T SAˆ 2 LT L M T M R PBˆ1 Aˆ 2T SBˆ 2 (33) ajoute à ce modèle les frottements secs présents dans tout
1
Bˆ1T P Bˆ 2T SAˆ 2 2 I Bˆ 2T SBˆ 2
système mécanique. Le modèle considéré pour l’étude est
y 1 0 0 0 wm xi
T
En appliquant le lemme de Schur modifié trois fois wl
successives à l’équation (33) ensuite en remplaçant les
équations (34), (35) et (36) dans le résultat puis en Les valeurs des paramètres du système sont décrites dans le
multipliant le résultat à droite et à gauche par tableau suivant:
T diag P41 , P31 , P21 , P11 , P21 , I , I , I , I enfin en Tableau.I. Les valeurs des paramètres du système
Copyright IPCO-2017
ISSN 2356-5608
Les figures 1 et 2 montrent que la sortie réelle suit la sortie 250
Signal de sortie désiré et signal de sortie réel
l’algorithme de commande par apprentissage itératif de type 150 signal de sortie désiré
signal de sortie réel
yk t et sortie désirée yd t ,
signal de sortie désiré et signal de sortie réel
250
200
150 signal de sortie désiré
signal de sortie réel
100
50
50
0
0 1 2 3 4 5 6
temps(s)
0
0 0.5 1 1.5 2 2.5 3 3.5 4 4.5 5
yk t et sortie désirée yd t ,
norme de l erreur
signal de sortie désiré et signal de sortie réel 400
250
350
norme de l erreur
200 300
maximum de l erreur
250
150
100
100
50 50
0
0 10 20 30 40 50 60 70 80 90 100
0 iteration k
0 1 2 3 4 5 6
temps(s)
yk t et sortie désirée yd t ,
e(t , k ) .
35
200
norme de l erreur
30
maximum de l erreur
15 100
10
5 50
0
0 20 40 60 80 100 120 140 160 180 200
iteration k
0
0 1 2 3 4 5 6
temps(s)
Copyright IPCO-2017
ISSN 2356-5608
250
signal de sortie désiré et signal de sortie réel [3]Masaru Uchiyama. Formulation of high-speed motion pattern of a
mechanical arm by trial. Transactions on Society of Instrumentation and
200
50
140, 1984.
[5]:John J. Craig. « Adaptive control of manipulators through repeated
0
0 1 2 3 4 5 6
temps(s) trials ». In Proceedings of American Control Conference, pages 1566–
1572, San Diego, CA, USA, June 1984.
Fig 8. Résultats de simulation à l’itération 15 de l’approche PD: Sortie
[6]:Masaki Togai and Osamu Yamano. Analysis and design of an optimal
yk t et sortie désirée yd t , learning control scheme for industrial robots: a discrete system approach.
In Proceedings of IEEE Conference on Decision and Control, pages 1399–
norme d erreur
14 1404, Ft. Lauderdale, FL, USA, December 1985.
12 [7]:Sadao Kawamura, Fumio Miyazki, and Suguru Arimoto. ―Realization
norme d erreur
10 maximum d erreur of robot motion based on a learning method”. IEEE Transactions on
8
Systems, Man, and Cybernetics, 18(1):126–134, January 1988.
6
[8] :Jian-Xin Xu and Zenn Z. Bien. ―The frontiers of iterative learning
4
control”. In Zeungnam Bien and Jian-Xin Xu, editors, Iterative Learning
2
Control: Analysis, Design, Integration and Applications, pages 9–35.
0
0 5
iteration k
10 15 Kluwer Academic Publishers, Boston, MA, USA, 1998.
[9]: Richard W. Longman. ―Iterative learning control and repetitive
Fig 9. La norme de l’erreur e(t , k ) et le maximum de l’erreur control for engineering practice”. International Journal of Control,
2
RILC : le correcteur proportionnel, le correcteur dérivé et le International Journal of Control, Automation, and Systems, vol. 11, no. 3,
pp.470-481, 2013
correcteur proportionnel dérivé. L’analyse et la synthèse de
[13]:J. Skultéty, E. Miclovicovà and R. Bars, ―Feedforward Control
la loi de commande est basée sur l’approche H∞ reliée aux Design Based on Laguerre Network Modelling‖, International Review of
techniques de résolution LMI. Nous avons utilisé un Automatic Control vol 7, no 5, pp.461-466, 2014.
exemple académique pour montrer l’efficacité et la [14]:Dridi Jamel, Ben attia Selma, Salhi Salah et Ksouri Mekki,
―Repetitive Processes Based Iterative Learning Control Designed by
simplicité de notre approche de commande itérative LMI”s, International Scholarly Research Network ISRN Applied
Mathematics, 2012.
robuste. Nous avons montré que le système est stable tout
au long des itérations et que la convergence est achevée [15]: Lukasz Hladowski, Krzysztof G., Zhonglun C., Eric R., Chris T. F. et
Paul L. L.,‖ A 2D Systems Approach to Iterative Learning Control for
dans un nombre très réduit d’itérations. Discrete Linear Processes with Zero First Markov Parameter, Symposium
on Learning Control”, at IEEE CDC, 2009.
REFERENCES
[1]: Murray Garden. ―Learning control of actuators in control systems‖. [16] Li Zhifu, Yuan Peng, Hu Yueming, Guo Qiwei, Ma Ge, ―LMI
United States Patent 03555252. Leeds & Northrup Company, Philadelphia, Approach to Robust Monotonically Convergent Iterative Learning Control
USA, January 1971. for Uncertain Linear Discrete time Systems,” Proceedings of the 31st
[2]:YuangQuan Chen and Kevin L. Moore. Comments on United States Chinese Control Conference, Hefei, China, 2012.
Patent 3555252 — learning control of actuators in control systems. In [17] :Carriere S, « Synthèse croisée de régulateurs et d'observateurs pour
Proceedings of The Sixth International Conference on Control, le contrôle robuste de la machine synchrone, PhD, Université de Toulouse,
France, 2010.
Automation, Robotics and Vision, Singapore, Singapore, December 2000.
Copyright IPCO-2017
ISSN 2356-5608