Please use this identifier to cite or link to this item: https://repositorio.ufu.br/handle/123456789/49941
Full metadata record
DC FieldValueLanguage
dc.creatorMesquita, Igor Melo-
dc.date.accessioned2026-08-28T12:54:17Z-
dc.date.available2026-08-28T12:54:17Z-
dc.date.issued2026-07-28-
dc.identifier.citationMESQUITA, Igor Melo. Estudo de caso do uso de um sistema de gerenciamento de banco de dados para detecção de cyberbullying. 2026. 55 f. Trabalho de Conclusão de Curso (Graduação em Sistemas de Informação) – Universidade Federal de Uberlândia, Uberlândia, 2026.pt_BR
dc.identifier.urihttps://repositorio.ufu.br/handle/123456789/49941-
dc.description.abstractThe ease of access to social media has intensified episodes of cyberbullying among users, a practice that negatively affects victims’ lives. Given this problem, this work aims to evaluate the applicability of PGVector (an extension for creating VDBMSs) in processes for detecting messages potentially associated with cyberbullying, combining semantic similarity search with a supervised machine learning model. To this end, data from the X platform (formerly Twitter) were collected and submitted to a method structured in six steps: textual preprocessing, vector representation, sampling, storage in PostgreSQL with the PGVector extension, classification, and evaluation of results. In the classification step, three embedding generation models were compared — SBERT, BERT, and FastText —, each combined with the kNN algorithm executed directly in the VDBMS. The results showed that SBERT achieved the best performance (k = 9, f1-score of 0.77), outperforming BERT (k = 7, f1-score of 0.65) and FastText (k = 5, f1-score of 0.59), confirming that embeddings optimized for similarity comparison are more suitable for this type of task. It is concluded that PostgreSQL, through PGVector, is capable of acting as a complete similarity-based classification environment, validating its applicability for cyberbullying detection.pt_BR
dc.description.sponsorshipPesquisa sem auxílio de agências de fomentopt_BR
dc.language.isopt_BRpt_BR
dc.publisherUniversidade Federal de Uberlândiapt_BR
dc.rightsAcesso Abertopt_BR
dc.rights.urihttp://creativecommons.org/licenses/by-nc-nd/3.0/us/*
dc.subjectCyberbullyingpt_BR
dc.subjectPGVectorpt_BR
dc.subjectEmbeddingspt_BR
dc.subjectSimilaridade semânticapt_BR
dc.subjectAprendizado de máquina supervisionadopt_BR
dc.titleEstudo de caso do uso de um sistema de gerenciamento de banco de dados para detecção de cyberbullyingpt_BR
dc.typeTrabalho de Conclusão de Cursopt_BR
dc.contributor.advisor1Barioni, Maria Camila Nardini-
dc.contributor.advisor1Latteshttp://lattes.cnpq.br/3785426518998830pt_BR
dc.contributor.referee1Paiva, Elaine Ribeiro de Faria-
dc.contributor.referee1Latteshttp://lattes.cnpq.br/8238524390290386pt_BR
dc.contributor.referee2Nascimento, Marcelo Zanchetta do-
dc.contributor.referee2Latteshttp://lattes.cnpq.br/5800175874658088pt_BR
dc.description.degreenameTrabalho de Conclusão de Curso (Graduação)pt_BR
dc.description.resumoA facilidade de acesso às redes sociais intensificou episódios de cyberbullying entre os usuários, prática que afeta negativamente a vida das vítimas. Diante dessa problemática, este trabalho tem como objetivo avaliar a aplicabilidade do PGVector (uma extensão para criar SGBDVs) em processos de detecção de mensagens potencialmente associadas ao cyberbullying, unindo busca por similaridade semântica a um modelo supervisionado de aprendizado de máquina. Com esse propósito, dados da plataforma X (antigo Twitter) foram coletados e submetidos a seis etapas: pré-processamento textual, representação vetorial, amostragem, armazenamento no PostgreSQL com a extensão PGVector, classificação e avaliação dos resultados. Na etapa de classificação, foram comparados três modelos de geração de embeddings — SBERT, BERT e FastText —, cada um combinado ao algoritmo kNN executado diretamente no SGBDV. Os resultados demonstraram que o SBERT apresentou o melhor desempenho (k = 9, f1-score de 0,77), superando o BERT (k = 7, f1-score de 0,65) e o FastText (k = 5, f1-score de 0,59), confirmando que embeddings otimizados para comparação por similaridade são mais adequados a esse tipo de tarefa. Conclui-se que o PostgreSQL, por meio do PGVector, é capaz de atuar como um ambiente completo de classificação por similaridade, validando sua aplicabilidade para a detecção de cyberbullying.pt_BR
dc.publisher.countryBrasilpt_BR
dc.publisher.courseSistemas de Informaçãopt_BR
dc.sizeorduration55pt_BR
dc.subject.cnpqCNPQ::CIENCIAS EXATAS E DA TERRA::CIENCIA DA COMPUTACAO::METODOLOGIA E TECNICAS DA COMPUTACAO::BANCO DE DADOSpt_BR
Appears in Collections:TCC - Sistemas de Informação (Uberlândia)

Files in This Item:
File Description SizeFormat 
EstudoCasoUso.pdfTrabalho de Conclusão de Curso5.95 MBAdobe PDFView/Open


This item is licensed under a Creative Commons License Creative Commons