Um Estudo Comparativo sobre o Uso de LLMs na Criação de Testes de Integração de Software

DSpace Repository

A- A A+

Um Estudo Comparativo sobre o Uso de LLMs na Criação de Testes de Integração de Software

Show simple item record

dc.contributor Universidade Federal de Santa Catarina. pt_BR
dc.contributor.advisor Barreto Vavassori Benitt, Fabiane
dc.contributor.author Guglielmi Kirtschig, Gabriel
dc.date.accessioned 2026-07-16T00:36:13Z
dc.date.available 2026-07-16T00:36:13Z
dc.date.issued 2026-07-06
dc.identifier.uri https://repositorio.ufsc.br/handle/123456789/274357
dc.description TCC (graduação) - Universidade Federal de Santa Catarina, Centro Tecnológico, Sistemas de Informação. pt_BR
dc.description.abstract Com o avanço da inteligência artificial, ferramentas baseadas em Large Language Models (LLMs) vêm transformando diversas etapas do desenvolvimento de software, especial- mente por meio da automação de tarefas repetitivas. No entanto, algumas áreas ainda são pouco exploradas por essas tecnologias, como é o caso da geração automatizada de testes de integração. Considerando a importância desse tipo de teste na garantia da quali- dade de sistemas complexos, este trabalho propõe a realização de um estudo comparativo sobre o uso de LLMs na geração de testes de integração de software. A pesquisa é con- duzida com base em um estudo de caso real, o sistema Jornada do Estudante, no qual diferentes modelos de LLM são avaliados por meio de técnicas de prompt engineering e métricas consolidadas na literatura. A metodologia adotada inclui a seleção das ferramen- tas mais indicadas, o planejamento e aplicação dos prompts e a análise dos testes gerados, buscando identificar os principais desafios, limitações e potencialidades dos LLMs nesse contexto. Os resultados obtidos revelaram que, com a aplicação de one-shot prompting, os modelos avaliados alcançaram alta conformidade aos padrões arquiteturais do projeto. O modelo GPT-5.4 destacou-se por apresentar o melhor equilíbrio e maior capacidade de propor novos cenários úteis. O DeepSeek-V4-Flash obteve a maior eficiência compu- tacional, sacrificando a eficácia funcional, enquanto o Gemini 2.5 Pro apresentou maior instabilidade na geração de código compilável. pt_BR
dc.format.extent 163 pt_BR
dc.language.iso por pt_BR
dc.publisher Florianópolis, SC. pt_BR
dc.rights Open Access. en
dc.subject Testes de integração pt_BR
dc.subject Inteligência artificial pt_BR
dc.subject Prompt engineering pt_BR
dc.subject Largue Language Models pt_BR
dc.subject Automação de testes pt_BR
dc.title Um Estudo Comparativo sobre o Uso de LLMs na Criação de Testes de Integração de Software pt_BR
dc.type TCCgrad pt_BR


Files in this item

Files Size Format View
TCC_Gabriel_Guglielmi_Kirtschig_Revisado.pdf 3.251Mb PDF View/Open

This item appears in the following Collection(s)

Show simple item record

Search DSpace


Advanced Search

Browse

My Account

Statistics

Compartilhar