Anonimização de dados clínicos para aprendizado de máquina: o equilíbrio entre privacidade e utilidade sob a LGPD

DSpace Repository

A- A A+

Anonimização de dados clínicos para aprendizado de máquina: o equilíbrio entre privacidade e utilidade sob a LGPD

Show simple item record

dc.contributor Universidade Federal de Santa Catarina. pt_BR
dc.contributor.advisor Inocêncio, Giovana
dc.contributor.author Valandro, Vitor
dc.date.accessioned 2026-07-12T17:47:13Z
dc.date.available 2026-07-12T17:47:13Z
dc.date.issued 2026-07-03
dc.identifier.uri https://repositorio.ufsc.br/handle/123456789/274070
dc.description TCC (graduação) - Universidade Federal de Santa Catarina, Centro Tecnológico, Sistemas de Informação. pt_BR
dc.description.abstract O uso secundário de dados clínicos para o treinamento de modelos de aprendizado de máquina esbarra na tensão entre a proteção de dados pessoais sensíveis, exigida pela Lei Geral de Proteção de Dados Pessoais (LGPD), e a preservação da utilidade desses dados. Este trabalho teve como objetivo avaliar o equilíbrio entre a proteção da privacidade e a preservação da utilidade clínica em modelos de aprendizado profundo aplicados a dados de terapia intensiva. Para tanto, foi conduzida uma avaliação orientada à tarefa sobre uma amostra de 17.917 admissões em unidades de terapia intensiva do banco de dados MIMIC-III. Três cenários progressivos de pseudonimização foram aplicados com a ferramenta ARX (k-anonimato; k-anonimato com l-diversidade; e Privacidade Diferencial), e o risco residual de reidentificação foi auditado sob três modelos de ameaça. A utilidade foi medida pelo desempenho de dois modelos de aprendizado profundo (ConCare e LSTM com fusão tardia) na predição de mortalidade hospitalar, avaliada por AUROC e AUPRC com intervalos de confiança de 95%. Os resultados mostraram que todos os cenários reduziram o risco máximo de reidentificação de 100% para menos de 4%; a combinação de k-anonimato e l-diversidade reduziu o risco a 1,37% com degradação de AUROC inferior a 0,5 ponto percentual e preservação integral da amostra. Os resultados indicam que, no cenário avaliado, a pseudonimização robusta pode reduzir o risco de reidentificação a níveis compatíveis com a abordagem baseada em risco da LGPD preservando a utilidade clínica, sugerindo que, para a base e a tarefa analisadas, a oposição entre privacidade e utilidade não é absoluta. pt_BR
dc.format.extent 109 pt_BR
dc.language.iso por pt_BR
dc.publisher Florianópolis, SC. pt_BR
dc.rights Open Access. en
dc.subject Anonimização de dados pt_BR
dc.subject Privacidade diferencial pt_BR
dc.subject LGPD pt_BR
dc.subject Aprendizado profundo pt_BR
dc.subject Dados clínicos pt_BR
dc.title Anonimização de dados clínicos para aprendizado de máquina: o equilíbrio entre privacidade e utilidade sob a LGPD pt_BR
dc.type TCCgrad pt_BR
dc.contributor.advisor-co Martina, Jean


Files in this item

Files Size Format View Description
TCC_ANONIMIZAÇ ... PRENDIZADO DE MÁQUINA.pdf 1.084Mb PDF View/Open TCC

This item appears in the following Collection(s)

Show simple item record

Search DSpace


Advanced Search

Browse

My Account

Statistics

Compartilhar