0% encontró este documento útil (0 votos)
2 vistas12 páginas

Control LQR vs Difuso en Péndulo Invertido

El informe presenta un análisis comparativo entre dos estrategias de control para un sistema de péndulo invertido: el Regulador Cuadrático Lineal (LQR) y el Control Difuso. Se detalla la modelización matemática del sistema, la implementación de ambos controladores y sus resultados en términos de seguimiento de trayectoria y estabilidad. Los resultados muestran que el control difuso ofrece un seguimiento más rápido y preciso en comparación con el LQR, que es más lento y presenta oscilaciones mayores.

Cargado por

Jeiki Os
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd
0% encontró este documento útil (0 votos)
2 vistas12 páginas

Control LQR vs Difuso en Péndulo Invertido

El informe presenta un análisis comparativo entre dos estrategias de control para un sistema de péndulo invertido: el Regulador Cuadrático Lineal (LQR) y el Control Difuso. Se detalla la modelización matemática del sistema, la implementación de ambos controladores y sus resultados en términos de seguimiento de trayectoria y estabilidad. Los resultados muestran que el control difuso ofrece un seguimiento más rápido y preciso en comparación con el LQR, que es más lento y presenta oscilaciones mayores.

Cargado por

Jeiki Os
Derechos de autor
© All Rights Reserved
Nos tomamos en serio los derechos de los contenidos. Si sospechas que se trata de tu contenido, reclámalo aquí.
Formatos disponibles
Descarga como PDF, TXT o lee en línea desde Scribd

Informe Control del Péndulo

Invertido
Análisis Comparativo de Control por Retroalimentación de Estados (LQR) y
Control Difuso

MARIACA GASPAR CARLOS ROMAN

RINCON FUENTES MICHAEL JAVIER


RUIZ CAMACHO NICOLAS SANTIAGO
9MC22

14 DE NOVIEMBRE DE 2025
INSTITUTO POLITECNICO NACIONAL
CONTROL INTELIGENTE
Índice
Objetivo General ................................................................................................... 2
Modelo Matemático y Linealización del Sistema ...................................................... 2
Parámetros Físicos del Sistema .......................................................................... 2
Modelo No Lineal ............................................................................................... 2
Linealización del Modelo .................................................................................... 3
Parte 1: Práctica Teórica - Regulador Cuadrático Lineal (LQR) ................................... 3
Fundamento Teórico .......................................................................................... 3
Metodología de Diseño....................................................................................... 4
Cálculo de Ganancias Óptimas .......................................................................... 4
Parte 2: Práctica de Simulación - Control Difuso ...................................................... 4
Diseño del Sistema de Inferencia Difusa (FIS) ...................................................... 5
Implementación y Comparación de Simulaciones ................................................... 6
Implementación A: Retroalimentación de Estados ............................................... 6
Implementación B: Control Difuso ...................................................................... 8
Comparación Directa ....................................................................................... 10
Conclusiones ..................................................................................................... 10
Objetivo General
Diseñar, simular y comparar dos estrategias de control distintas para la estabilización
y seguimiento de trayectoria de un sistema de péndulo invertido sobre un carro móvil.
La primera estrategia se basa en la teoría del Regulador Cuadrático Lineal (LQR) y la
segunda en la Lógica Difusa.

Modelo Matemático y Linealización del Sistema


El primer paso para cualquier diseño de control basado en modelo es obtener una
representación matemática precisa del sistema físico.

Parámetros Físicos del Sistema


• Masa del carro (M): 0.455 kg

• Masa del péndulo (m): 0.21 kg

• Longitud de la varilla (l): 0.305 m

• Aceleración de la gravedad (g): 9.8 m/s²

Modelo No Lineal
Se define un vector de estados 𝑥 = [𝑥1 , 𝑥2 , 𝑥3 , 𝑥4 ]𝑇 donde:

• 𝑥1 : Posición del carro

• 𝑥2 : Velocidad del carro

• 𝑥3 : Ángulo del péndulo (0 = vertical)

• 𝑥4 : Velocidad angular del péndulo

Las ecuaciones dinámicas no lineales del sistema, 𝑥̇ = 𝑓(𝑥, 𝑢) se derivan de las leyes
de Newton [cite: 1-10] [cite_start]y se consolidan en el siguiente modelo

• 𝑓1 = 𝑥1̇ = 𝑥2
𝑚𝑙 sin(𝑥3 )𝑥42 −𝑚𝑔 sin(𝑥3 ) cos(𝑥3 )+𝑢
• 𝑓2 = 𝑥2̇ = 𝑀+𝑚 sin2(𝑥3 )

• 𝑓3 = 𝑥3̇ = 𝑥4
(𝑀+𝑚) sin(𝑥3 )−𝑢 cos(𝑥3 )−𝑚𝑙 sin(𝑥3 ) cos(𝑥3 )𝑥42
• 𝑓4 = 𝑥4̇ = 𝑙𝑀+𝑙𝑚 sin2 (𝑥3 )
Este modelo no lineal se implementó en Simulink (image_ac4ca7.png) para la
simulación del controlador difuso, representando una aproximación más fiel a la
realidad.

Linealización del Modelo


Para aplicar técnicas de control lineal (como LQR), el modelo debe ser linealizado
alrededor de su punto de equilibrio inestable (𝑥 = 0, 𝑢 = 0). El sistema linealizado 𝑥̇ =
𝜕𝑓 𝜕𝑓
𝐴𝑥 + 𝐵𝑢 se obtiene calculando las matrices Jacobianas 𝐴 = 𝜕𝑥 𝑦 𝐵 = 𝜕𝑢 en dicho
punto.

Matriz A:
0 1 0 0
𝑚𝑔 0 1 0 0
0 0 − 0
𝑀
𝐴= 0 1 = [0 0 −4.5319 0]
0 0 0 0
0 0 (𝑀 + 𝑚)𝑔
0] 0 0 47.164 1
[0 0 𝑙𝑀
Matriz B:
0
1 0
𝐵 = 𝑀 = [ 2.1978 ]
0 0
1 −7.2059
[− 𝑙𝑀]

Este modelo linealizado (image_ac500a.png) es la base para el diseño teórico del LQR
y para la simulación del control por retroalimentación de estados.

Parte 1: Práctica Teórica - Regulador Cuadrático Lineal (LQR)


Esta primera parte de la práctica se centra en el desarrollo teórico del Regulador
Cuadrático Lineal (LQR), una técnica de control óptimo para calcular ganancias de
retroalimentación de estados.

Fundamento Teórico
El control LQR busca encontrar una ley de control 𝑢(𝑡) = −𝐾𝑥(𝑡) que sea "óptima".
Esta optimalidad se define minimizando una función de costo 𝐽, que pondera el
compromiso entre la rapidez de la respuesta (error de estado) y la energía utilizada
(esfuerzo de control):

𝐽 = ∫ (𝑥 𝑇 (𝑡)𝑄𝑥 (𝑡) + 𝑢𝑇 (𝑡)𝑅𝑢 (𝑡))𝑑𝑡
0

• 𝑄: Matriz simétrica definida positiva que penaliza el error en los estados.


Valores mayores en 𝑄 fuerzan al sistema a estabilizarse más rápido.

• 𝑅: Matriz simétrica definida positiva que penaliza el esfuerzo de control 𝑢(𝑡).


Valores mayores en 𝑅 resultan en un control más suave y de menor energía.

Metodología de Diseño
La matriz de ganancia óptima 𝐾 que minimiza 𝐽 se obtiene en dos pasos:

1. Resolver la Ecuación Algebraica de Riccati (ARE): Se debe encontrar la


matriz 𝑃 (simétrica, definida positiva) que satisface:

𝐴𝑇 𝑃 + 𝑃𝐴 − 𝑃𝐵𝑅 −1 𝐵 𝑇 𝑃 + 𝑄 = 0

2. Calcular la Ganancia Óptima 𝐾: Una vez obtenida PP, la ganancia se calcula


como:

𝐾 = 𝑅 −1 𝐵𝑇 𝑃

Cálculo de Ganancias Óptimas


Para esta práctica, el procedimiento de diseño ([Link]) establece los siguientes
parámetros:

• 𝑹 = 𝟎. 𝟎𝟒
1 0 0 0
• 𝑸 = 𝑪^𝑻𝑪, donde 𝐶=[ ] (penalizando error de posición
0 0 1 0
𝑥1 𝑦 𝑎𝑛𝑔𝑢𝑙𝑜 𝑥3 ).

Usando el comando care de Matlab (𝑃 = 𝑐𝑎𝑟𝑒(𝐴, 𝐵, 𝑄, 𝑅)), el resultado teórico de


esta primera práctica es el vector de ganancias óptimas Kopt:

𝐾𝑜𝑝𝑡 = [−5.0000, −4.3359, −25.3095, −3.9734]

Parte 2: Práctica de Simulación - Control Difuso


Esta segunda parte de la práctica se enfoca en el control difuso, una técnica basada
en el conocimiento heurístico y la experiencia del operador, que teóricamente no
precisa de un modelo matemático.
Diseño del Sistema de Inferencia Difusa (FIS)
En la práctica, se diseñó un controlador que combina la lógica difusa con una
retroalimentación de estados. El componente difuso (fuzzyPendulo) es un sistema
Mamdani diseñado para actuar sobre el error de posición.

Figura 1

• Entradas:

1. angle: Error de posición (𝑟1 − 𝑥1 ).

2. derivada: Derivada del error de posición (𝑒̇𝑝𝑜𝑠 ).

• Salida:

1. fuerza: Componente difusa de la señal de control (𝑢𝑓𝑢𝑧𝑧𝑦 ).

• Funciones de Pertenencia: Se utilizó una configuración simple para las tres


variables. Cada una tiene dos funciones de pertenencia triangulares/lineales
(trimf) en el rango [-6, 6]: NEG y POS.

Figura 2. Funciones de pertenencia para las variables de entrada y salida.


• Reglas de Inferencia: Se definieron 4 reglas (tipo AND) que constituyen la base
de conocimiento heurístico:

1. Si (angle es NEG) y (derivada es NEG) entonces (fuerza es POS)

2. Si (angle es NEG) y (derivada es POS) entonces (fuerza es POS)

3. Si (angle es POS) y (derivada es NEG) entonces (fuerza es NEG)

4. Si (angle es POS) y (derivada es POS) entonces (fuerza es NEG)

Esta base de reglas se simplifica a un controlador Proporcional (P) sobre el error de


posición: si el error es negativo, la fuerza es positiva, y viceversa.

Implementación y Comparación de Simulaciones


Para la simulación y comparación, se implementaron dos arquitecturas de control
distintas. Es crucial notar que la "Implementación A" no utiliza las ganancias KoptKopt
calculadas en la Parte 1, sino un conjunto de ganancias sintonizadas manualmente,
lo que permite una comparación más directa con el sistema difuso.

Implementación A: Retroalimentación de Estados


• Se utilizó el modelo linealizado

Figura 3

• Ley de Control: 𝑢 = 𝐺𝑝 ⋅ (𝑟1 − 𝑥1 ) − 𝐾𝑚𝑎𝑛𝑢𝑎𝑙 ⋅ 𝑥𝑢

• Ganancias (Sintonizadas):
o 𝐾𝑚𝑎𝑛𝑢𝑎𝑙 = [0, −25, −150, −15]]

o 𝐺𝑝 = −5 (𝐺𝑎𝑛𝑎𝑛𝑐𝑖𝑎 𝑑𝑒 𝑝𝑟𝑒 −
𝑐𝑜𝑚𝑝𝑒𝑛𝑠𝑎𝑐𝑖ó𝑛 𝑠𝑖𝑛𝑡𝑜𝑛𝑖𝑧𝑎𝑑𝑎 𝑝𝑜𝑟 𝑝𝑟𝑢𝑒𝑏𝑎 𝑦 𝑒𝑟𝑟𝑜𝑟).

• Resultados (Implementación A):

o Seguimiento de Posición (𝑥1 ): La Figura 4 muestra la respuesta a una


referencia de ±6. El carro (azul) sigue la referencia (amarilla) de
forma estable y suave, pero es visiblemente lento, tardando varios
segundos en alcanzar el valor deseado.

o Estabilidad del Péndulo (𝜃): La gráfica inferior de la Figura 5 muestra el


ángulo 𝑥3 . Aunque el controlador lo estabiliza, el movimiento del carro
induce oscilaciones muy grandes de ±0.4 radianes (aprox. 23°).

Figura 4. Resultados de la Implementación A. Posición x1x1

Figura 5. Resultados de la Implementación A. Ángulo 𝑥3


Implementación B: Control Difuso
• Se utilizó el modelo no lineal, más realista.

Figura 6

Figura 7

• Ley de Control: 𝑢 = 𝑢𝑓𝑢𝑧𝑧𝑦 − 𝐾𝑚𝑎𝑛𝑢𝑎𝑙 ⋅ 𝑥

• Ganancias:

o 𝐾𝑚𝑎𝑛𝑢𝑎𝑙 = [0, −25, −150, −15](𝐿𝑎 𝑚𝑖𝑠𝑚𝑎 𝑔𝑎𝑛𝑎𝑛𝑐𝑖𝑎 𝑏𝑎𝑠𝑒 𝑞𝑢𝑒 𝐴).

o 𝑢𝑓𝑢𝑧𝑧𝑦 : 𝑆𝑎𝑙𝑖𝑑𝑎 𝑑𝑒𝑙 𝐹𝐼𝑆 𝑑𝑖𝑠𝑒ñ𝑎𝑑𝑜 𝑒𝑛 𝑙𝑎 𝑃𝑎𝑟𝑡𝑒 2.

• Resultados (Implementación B):

o Seguimiento de Posición (𝒙𝟏 ): La Figura 8 muestra la respuesta a una


referencia de ±1.5. El seguimiento es extremadamente rápido y
preciso, con la posición (azul) siguiendo la referencia (amarilla) casi
perfectamente.

o Estabilidad del Péndulo (𝜽): La Figura 10 muestra que el ángulo 𝑥3 se


mantiene excepcionalmente estable. Las oscilaciones son mínimas,
de solo ±0.06 radianes (aprox. 3.4°), incluso durante los cambios
abruptos de dirección del carro.
Figura 8. Posición x_1 de la Implementación B

Figura 9. Resultados Implementación B. Señal Control u

Figura 10. Resultados Implementación B. Ángulo x_3.


Comparación Directa
Característica Implementación A (Retro. Estados) Implementación B (Difuso)

Modelo de
Linealizado No Lineal
Simulación

Ganancia
𝐾𝑚𝑎𝑛𝑢𝑎𝑙 = [0, −25, −150, −15] 𝐾𝑚𝑎𝑛𝑢𝑎𝑙 = [0, −25, −150, −15]
Base 𝐾

Control
𝐺𝑎𝑛𝑎𝑛𝑐𝑖𝑎 𝐺𝑝 = −5 (𝐸𝑟𝑟𝑜𝑟 𝑑𝑒 𝑃𝑜𝑠. ) FIS (Error de Pos. + Derivada)
Adicional

Rendimiento Extremadamente rápido y


Lento, suave, estable.
(𝑥1 ) preciso.

Estabilidad Oscilaciones mínimas


Oscilaciones grandes (±0.4 rad)
(𝜃) (±0.06 rad)

Análisis Comparativo: El controlador Difuso (Implementación B) demostró


ser visiblemente superior en todas las métricas de desempeño, a pesar de operar
sobre el modelo no lineal más complejo.

La clave de la comparación es que ambos sistemas usaron la misma ganancia de


retroalimentación de estados KmanualKmanual. La única diferencia fue el controlador
"feed-forward" (una ganancia fija −5 en A vs. el FIS dinámico en B).

1. Estabilidad: La adición del FIS redujo la oscilación del péndulo casi 7 veces (de
0.4 a 0.06 rad). Esto prueba que la lógica difusa proporcionó una acción de
control mucho más inteligente que suprimió las oscilaciones inducidas por el
movimiento.

2. Seguimiento: El controlador B fue drásticamente más rápido y preciso en el


seguimiento de la referencia.

Conclusiones
Esta práctica doble permitió analizar el control del péndulo invertido desde dos
perspectivas teóricas y una comparativa de simulación.
1. Práctica LQR: Se completó el desarrollo teórico del control LQR, obteniendo un
vector de ganancias óptimas KoptKopt mediante la resolución de la Ecuación
de Riccati, cumpliendo con la primera parte de la asignación.

2. Práctica Difusa: Se diseñó un controlador difuso (FIS) basado en reglas


heurísticas simples para actuar sobre el error de posición, cumpliendo con la
segunda parte.

3. Comparación Práctica: El hallazgo más significativo provino de la simulación.


El controlador de retroalimentación de estados (Implementación A) logró
estabilizar el sistema lineal, pero con un desempeño lento y oscilatorio.

4. El controlador Difuso fue superior. Al combinar la misma retroalimentación


de estados con la lógica difusa, el sistema (operando sobre el modelo no lineal)
logró un seguimiento de referencia casi perfecto y una estabilización del
péndulo drásticamente mejorada.

Se concluye que la adición de un controlador difuso simple para gestionar el error de


seguimiento mejoró significativamente el desempeño general del sistema de control
base.

También podría gustarte