Please use this identifier to cite or link to this item: https://repositorio.ufu.br/handle/123456789/50470
ORCID:  http://orcid.org/0009-0006-6571-9552
Document type: Dissertação
Access type: Acesso Aberto
Title: Comparação entre algoritmos de aprendizado por reforço profundo e controlador PID aplicados ao seguimento de linha
Alternate title (s): Comparison of deep reinforcement learning algorithms and PID controller applied to line following
Author: Souza Junior, Fabio Romero de
First Advisor: Ramos, Daniel Costa
First member of the Committee: Carvalho, Sidney Roberto Dias De
Second member of the Committee: Lima, Gabriela Vieira
Summary: Este trabalho apresenta uma avaliação experimental comparativa entre seis algoritmos de aprendizado por reforço profundo Deep Deterministic Policy Gradient (DDPG), Twin Delayed DDPG (TD3), Soft Actor-Critic (SAC), Proximal Policy Optimization (PPO), Advantage Actor-Critic (A2C) e Model-Based Reinforcement Learning (MBRL) e o controlador Proporcional-Integral-Derivativo (PID), aplicados ao problema de seguimento de linha por visão computacional em um robô móvel diferencial. Os experimentos foram conduzidos em ambiente simulado, considerando três cenários de complexidade geométrica crescente e duas velocidades de operação, correspondentes a 50% e 75% da velocidade máxima estável do robô. A avaliação considerou métricas de precisão, estabilidade, esforço de controle, taxa de conclusão e robustez. Os resultados indicam que o DDPG apresentou o melhor equilíbrio entre precisão e taxa de conclusão nos cenários avaliados, mantendo desempenho consistente mesmo com o aumento da velocidade. O PID demonstrou resultados competitivos em condições estáveis, com menor esforço de controle, mas apresentou sensibilidade ao aumento de velocidade. Os demais algoritmos de aprendizado por reforço apresentaram erros de rastreamento significativamente maiores. Os resultados reforçam o potencial do aprendizado por reforço profundo para tarefas de controle contínuo em robótica móvel, evidenciando que a escolha do método mais adequado depende dos requisitos específicos da aplicação.
Abstract: This work presents an experimental comparative evaluation of six deep reinforcement learning algorithms Deep Deterministic Policy Gradient (DDPG), Twin Delayed DDPG (TD3), Soft Actor-Critic (SAC), Proximal Policy Optimization (PPO), Advantage Actor-Critic (A2C), and Model-Based Reinforcement Learning (MBRL) and a Proportional-Integral-Derivative (PID) controller, applied to the line-following task using computer vision on a differential mobile robot. The experiments were conducted in a simulated environment, considering three scenarios of increasing geometric complexity and two operating speeds, corresponding to 50% and 75% of the robot's maximum stable velocity. The evaluation considered metrics of precision, stability, control effort, completion rate, and robustness. The results indicate that DDPG achieved the best balance between accuracy and completion rate across all evaluated scenarios, maintaining consistent performance even as speed increased. The PID controller demonstrated competitive results under stable conditions, with lower control effort, but showed sensitivity to speed increases. The remaining reinforcement learning algorithms presented significantly higher tracking errors. Overall, the results reinforce the potential of deep reinforcement learning for continuous control tasks in mobile robotics, highlighting that the most suitable method depends on the specific requirements of the application.
Keywords: Aprendizado por Reforço Profundo
Seguimento de linha
Visão Computacional
Robótica Móvel
Deep Reinforcement Learning
Trajectory Following
Computer Vision
Mobile Robotics
PID Controller
Area (s) of CNPq: CNPQ::ENGENHARIAS::ENGENHARIA ELETRICA
Subject: Engenharia elétrica
Algorítmos computacionais
Robótica
Country: Brasil
Publisher: Universidade Federal de Uberlândia
Program: Programa de Pós-graduação em Engenharia Elétrica
Quote: SOUZA JÚNIOR, Fabio Romero de. Comparação entre algoritmos de aprendizado por reforço profundo e controlador PID aplicados ao seguimento de linha. 2026. Dissertação (Mestrado em Engenharia Elétrica) – Universidade Federal de Uberlândia, Uberlândia, 2026. DOI: http://doi.org/10.14393/ufu.di.2026.694
Document identifier: http://doi.org/10.14393/ufu.di.2026.694
URI: https://repositorio.ufu.br/handle/123456789/50470
Date of defense: 31-Aug-2026
Sustainable Development Goals SDGs: ODS::ODS 9. Indústria, Inovação e infraestrutura - Construir infraestrutura resiliente, promover a industrialização inclusiva e sustentável, e fomentar a inovação.
Appears in Collections:DISSERTAÇÃO - Engenharia Elétrica

Files in This Item:
File SizeFormat 
Comparação entre algoritmos de aprendizado .pdf2.8 MBAdobe PDFView/Open


Items in DSpace are protected by copyright, with all rights reserved, unless otherwise indicated.