Detecção de prompt injection em modelos de linguagem

Kaydedildi:
Detaylı Bibliyografya
Yazar: Gonçalves, Júlia Jamile Oliveira
Yayın Tarihi: 2026
Materyal Türü: Master thesis
Dil: por
Kaynak: Repositório Institucional da UnB
Download full: http://repositorio.unb.br/handle/10482/54704
Özet: Dissertação (mestrado) — Universidade de Brasília, Faculdade de Tecnologia, Departamento de Engenharia Elétrica, Programa de Pós-Graduação Profissional em Engenharia Elétrica, 2026.
_version_ 1871442238007934976
author Gonçalves, Júlia Jamile Oliveira
author_browse Gonçalves, Júlia Jamile Oliveira
author_facet Gonçalves, Júlia Jamile Oliveira
author_role author
bitstream.checksum.fl_str_mv 1555aa688e76947ff2fde20549d848c7
bitstream.checksumAlgorithm.fl_str_mv MD5
bitstream.url.fl_str_mv http://repositorio.unb.br/bitstream/10482/54704/1/JuliaJamileOliveiraGoncalves_DISSERT.pdf
collection Repositório Institucional da UnB
contributor_str_mv Amvame-Nze, Georges Daniel
dc.contributor.advisor1.fl_str_mv Amvame-Nze, Georges Daniel
dc.contributor.author.fl_str_mv Gonçalves, Júlia Jamile Oliveira
dc.date.accessioned.fl_str_mv 2026-06-10T13:25:38Z
dc.date.available.fl_str_mv 2026-06-10T13:25:38Z
dc.date.issued.fl_str_mv 2026-06-10
dc.date.submitted.none.fl_str_mv 2026-01-29
dc.identifier.citation.fl_str_mv GONÇALVES, Júlia Jamile Oliveira. Detecção de prompt injection em modelos de linguagem. 2026. 63 f., il. Dissertação (Mestrado Profissional em Engenharia Elétrica) — Universidade de Brasília, Brasília, 2026.
dc.identifier.uri.fl_str_mv http://repositorio.unb.br/handle/10482/54704
dc.language.iso.fl_str_mv por
dc.rights.driver.fl_str_mv info:eu-repo/semantics/openAccess
dc.source.none.fl_str_mv reponame:Repositório Institucional da UnB
instname:Universidade de Brasília (UnB)
instacron:UNB
dc.subject.keyword.pt_BR.fl_str_mv Inteligência artificial
Modelos de linguagem
Aprendizado de máquina
dc.title.pt_BR.fl_str_mv Detecção de prompt injection em modelos de linguagem
dc.type.driver.fl_str_mv info:eu-repo/semantics/masterThesis
dc.type.status.fl_str_mv info:eu-repo/semantics/publishedVersion
description Dissertação (mestrado) — Universidade de Brasília, Faculdade de Tecnologia, Departamento de Engenharia Elétrica, Programa de Pós-Graduação Profissional em Engenharia Elétrica, 2026.
eu_rights_str_mv openAccess
format masterThesis
id UNB_219fbb30bd2e0a7bd5ac41707e85aeaa
identifier_str_mv GONÇALVES, Júlia Jamile Oliveira. Detecção de prompt injection em modelos de linguagem. 2026. 63 f., il. Dissertação (Mestrado Profissional em Engenharia Elétrica) — Universidade de Brasília, Brasília, 2026.
instacron_str UNB
institution UNB
instname_str Universidade de Brasília (UnB)
language por
network_acronym_str UNB
network_name_str Repositório Institucional da UnB
oai_identifier_str oai:repositorio.unb.br:10482/54704
publishDate 2026
publishDateSort 2026
reponame_str Repositório Institucional da UnB
repository.mail.fl_str_mv repositorio@unb.br
repository.name.fl_str_mv Repositório Institucional da UnB - Universidade de Brasília (UnB)
repository_id_str
spelling Gonçalves, Júlia Jamile OliveiraAmvame-Nze, Georges Daniel2026-06-10T13:25:38Z2026-06-10T13:25:38Z2026-06-102026-01-29GONÇALVES, Júlia Jamile Oliveira. Detecção de prompt injection em modelos de linguagem. 2026. 63 f., il. Dissertação (Mestrado Profissional em Engenharia Elétrica) — Universidade de Brasília, Brasília, 2026.http://repositorio.unb.br/handle/10482/54704Dissertação (mestrado) — Universidade de Brasília, Faculdade de Tecnologia, Departamento de Engenharia Elétrica, Programa de Pós-Graduação Profissional em Engenharia Elétrica, 2026.Os Modelos de Linguagem de Grande Escala (LLMs) são amplamente utilizados na indústria e na academia para tarefas diversas, como assistentes virtuais e automação de processos. No entanto, essas tecnologias apresentam vulnerabilidades de segurança, como ataques de Prompt Injection, que podem comprometer a integridade e confiabilidade dos modelos. Este estudo propõe uma abordagem baseada em aprendizado de máquina para detectar ataques de Prompt Injection e comparar sua eficácia com modelos tradicionais. Experimentos foram conduzidos utilizando modelos como BERT, CountVectorizer e TfidfVectorizer, demonstrando que técnicas de Oversampling aprimoram a detecção dessas ameaças.Large Language Models (LLMs) are widely utilized in industry and academia for diverse tasks, such asvirtual assistants and process automation. However, these technologies exhibit security vulnerabilities,including Prompt Injection attacks, which can compromise model integrity and reliability. This study pro poses a machine learning-based approach to detect Prompt Injection attacks and compare its effectivenessagainst traditional models.A bilingual dataset containing legitimate and malicious prompts, encompassing various Prompt Injec tion attack variations, was constructed. The dataset was evaluated under three distinct scenarios: originalivimbalanced distribution, undersampling, and oversampling. Multiple machine learning pipelines were trai ned, combining text vectorization techniques (CountVectorizer and TF-IDF) with traditional classifiers,alongside BERT-based model training. Additionally, LLMs were employed for comparative behavioralanalysis against input prompts.Experimental results demonstrated that oversampling strategies consistently produce superior perfor mance, with significant false negative reduction. TF-IDF-based pipelines combined with linear classifiers,as well as the BERT model, achieved accuracy and F1-score values exceeding 97%, evidencing high ef fectiveness in attack detection. Confusion matrix analysis reinforced the importance of class balancing insecurity scenarios, where attack non-detection can have critical impacts.The results indicate that effective Prompt Injection detection mechanisms can be implemented evenin computationally limited environments, contributing to enhanced security and reliability of LLM-basedapplications.Faculdade de Tecnologia (FT)Departamento de Engenharia Elétrica (FT ENE)Programa de Pós-Graduação em Engenharia Elétrica, Mestrado ProfissionalporA concessão da licença deste item refere-se ao termo de autorização impresso assinado pelo autor com as seguintes condições: Na qualidade de titular dos direitos de autor da publicação, autorizo a Universidade de Brasília e o IBICT a disponibilizar por meio dos sites www.unb.br, www.ibict.br, www.ndltd.org sem ressarcimento dos direitos autorais, de acordo com a Lei nº 9610/98, o texto integral da obra supracitada, conforme permissões assinaladas, para fins de leitura, impressão e/ou download, a título de divulgação da produção científica brasileira, a partir desta data.info:eu-repo/semantics/openAccessDetecção de prompt injection em modelos de linguageminfo:eu-repo/semantics/publishedVersioninfo:eu-repo/semantics/masterThesisInteligência artificialModelos de linguagemAprendizado de máquinareponame:Repositório Institucional da UnBinstname:Universidade de Brasília (UnB)instacron:UNBORIGINALJuliaJamileOliveiraGoncalves_DISSERT.pdfapplication/pdf6160092http://repositorio.unb.br/bitstream/10482/54704/1/JuliaJamileOliveiraGoncalves_DISSERT.pdf1555aa688e76947ff2fde20549d848c7MD51open access10482/547042026-06-10 15:14:22.517open accessoai:repositorio.unb.br:10482/54704Repositório InstitucionalPUBhttps://repositorio.unb.br/oai/requestrepositorio@unb.bropendoar:2026-06-10T18:14:22Repositório Institucional da UnB - Universidade de Brasília (UnB)
spellingShingle Detecção de prompt injection em modelos de linguagem
Gonçalves, Júlia Jamile Oliveira
Inteligência artificial
Modelos de linguagem
Aprendizado de máquina
status_str publishedVersion
title Detecção de prompt injection em modelos de linguagem
title_full Detecção de prompt injection em modelos de linguagem
title_fullStr Detecção de prompt injection em modelos de linguagem
title_full_unstemmed Detecção de prompt injection em modelos de linguagem
title_short Detecção de prompt injection em modelos de linguagem
title_sort Detecção de prompt injection em modelos de linguagem
topic Inteligência artificial
Modelos de linguagem
Aprendizado de máquina
url http://repositorio.unb.br/handle/10482/54704