Logotipo do repositório

Integração de large language models e graph neural networks para otimizar classificação de texto e extração de conhecimento

dc.contributor.advisorBreve, Fabricio Aparecido [UNESP]
dc.contributor.authorMenezes, Larissa Pessoa Sá [UNESP]
dc.contributor.committeeMemberBreve, Fabricio Aparecido [UNESP]
dc.contributor.committeeMemberCarvalho, Veronica Oliveira de [UNESP]
dc.contributor.committeeMemberRezende, Solange Oliveira
dc.contributor.institutionUniversidade Estadual Paulista (Unesp)
dc.date.accessioned2026-04-09T15:11:07Z
dc.date.issued2026-02-13
dc.description.abstractA representação estruturada do conhecimento humano e o avanço dos Large Language Models (LLMs) têm impulsionado novas fronteiras na Inteligência Artificial. Neste contexto, os grafos de conhecimento (KGs) emergem como ferramentas essenciais para organizar informações complexas, permitindo sua integração com técnicas de aprendizado profundo. Este trabalho introduz o GenGraph, um framework com abordagem híbrida que combina o modelo generativo Gemini AI e o extrator de relações REBEL com Graph Convolutional Networks (GCNs) para otimizar a classificação textual. A metodologia utiliza o Gemini para refinamento textual e extração de conhecimento estruturado em triplas, comparando sua eficácia com o modelo REBEL na construção de grafos heterogêneos. Os experimentos realizados nos datasets BBC News, Reuters-21578, AG News e 20 Newsgroups demonstra ram a robustez da arquitetura proposta, com destaque para o desempenho no dataset 20 Newsgroups, que alcançou 96,91% de acurácia de validação, superando baselines como TextGCN e ChatGraph. A análise comparativa revelou que, enquanto o REBEL ofereceu maior estabilidade e eficiência na extração de triplas (87,65% de acurácia no AG News), a combinação de embeddings densos (BERT) e arestas semânticas provou-se determinante para a performance global, mitigando a necessidade de pré-refinamento textual em cenários de alta complexidade como o Reuters.pt
dc.description.abstractThe structured representation of human knowledge and the advancement of Large Language Models (LLMs) have driven new frontiers in Artificial Intelligence. In this context, Knowledge Graphs (KGs) emerge as essential tools for organizing complex information, enabling their integration with deep learning techniques. This work introduces GenGraph, a hybrid framework that combines the generative model Gemini AI and the relation extractor REBEL with Graph Convolutional Networks (GCNs) to optimize text classification. The methodology utilizes Gemini for text refinement and structured knowledge extraction into triplets, comparing its effectiveness with the REBEL model in the construction of heterogeneous graphs. Experiments conducted on the BBC News, Reuters-21578, AG News, and 20 Newsgroups datasets demonstrated the robustness of the proposed architecture, highlighting the performance on the 20 Newsgroups dataset, which achieved 96.91% validation accuracy, surpassing baselines such as TextGCN and ChatGraph. Comparative analysis revealed that while REBEL offered greater stability and efficiency in triplet extraction (87.65% accuracy on AG News), the combination of dense embeddings (BERT) and semantic edges proved decisive for global performance, mitigating the need for text pre-refinement in high-complexity scenarios such as Reuters.en
dc.description.sponsorshipIdNão recebi financiamento
dc.identifier.capes33004153073P2
dc.identifier.citationMENEZES, Larissa Pessoa Sá. Integração de Large Language Models e Graph Neural Networks para Otimizar Classificação de Texto e Extração de Conhecimento. 2026. Dissertação (Mestrado em Ciência da Computação) - Instituto de Geociência e Ciências Exatas, Universidade Estadual Paulista (UNESP), Rio Claro, 2026.
dc.identifier.lattes4277029770540460
dc.identifier.orcid0000-0001-5661-1669
dc.identifier.urihttps://hdl.handle.net/11449/320946
dc.language.isopor
dc.publisherUniversidade Estadual Paulista (Unesp)
dc.rights.accessRightsAcesso abertopt
dc.subjectInteligência artificialpt
dc.subjectRedes neurais (Computação)pt
dc.subjectProcessamento humano da informaçãopt
dc.subjectModelos de linguagem de grande escalapt
dc.subjectGeminipt
dc.subjectGrafos de conhecimentopt
dc.subjectArtificial intelligenceen
dc.subjectNeural networks (Computer science)en
dc.subjectHuman information processingen
dc.subjectLarge language modelsen
dc.subjectKnowledge graphsen
dc.titleIntegração de large language models e graph neural networks para otimizar classificação de texto e extração de conhecimentopt
dc.title.alternativeIntegration of large language models and graph neural networks to optimize text classification and knowledge extractionen
dc.typeDissertação de mestradopt
dspace.entity.typePublication
relation.isAuthorOfPublication4348fa95-7006-4c98-8d6b-742bd3716573
relation.isAuthorOfPublication.latestForDiscovery4348fa95-7006-4c98-8d6b-742bd3716573
relation.isGradProgramOfPublicationd7c91376-28ac-4ea8-aada-e75db43fbca8
relation.isGradProgramOfPublication.latestForDiscoveryd7c91376-28ac-4ea8-aada-e75db43fbca8
relation.isOrgUnitOfPublication4763ec56-704e-41e0-9685-b5bef5946feb
relation.isOrgUnitOfPublication.latestForDiscovery4763ec56-704e-41e0-9685-b5bef5946feb
unesp.campusUniversidade Estadual Paulista (UNESP), Instituto de Geociências e Ciências Exatas, Rio Claropt
unesp.embargoOnlinept
unesp.examinationboard.typeBanca públicapt
unesp.graduateProgramCiência da Computação - FC/FCT/IBILCE/IGCEpt
unesp.knowledgeAreaComputação aplicadapt
unesp.researchAreaInteligência computacionalpt

Arquivos

Pacote original

Agora exibindo 1 - 1 de 1
Carregando...
Imagem de Miniatura
Nome:
menezes_lps_me_rcla.pdf
Tamanho:
3,76 MB
Formato:
Adobe Portable Document Format