Imagem de fundo

Uma certa organização gostaria de compartilhar dados com um grupo de pesquisadores de u...

Uma certa organização gostaria de compartilhar dados com um grupo de pesquisadores de uma universidade para a condução de um estudo sobre problemas ergonômicos nos seus escritórios. Entre os dados coletados, há informações sensíveis sobre seus funcionários; portanto, o responsável pela coleta decidiu anonimizar os dados. Isso foi feito removendo-se nomes e outros campos identificadores e adicionando-se um número identificador próprio a cada funcionário. Dessa forma, a identidade dos funcionários seria preservada. Após a verificação de uma amostra, o pesquisador responsável pelo estudo recomendou medidas que deveriam ser aplicadas antes que os dados pudessem ser aceitos para o estudo.


O problema que mais provavelmente motivou a recomendação do pesquisador e uma medida que pode mitigar esse problema são, respectivamente:


A

os dados podem ser reidentificados usando uma combinação dos campos restantes → embaralhamento dos campos;


B

o número identificador não é suficiente para separar os dados → hashing usando os campos restantes;


C

os dados podem ser reidentificados utilizando dados externos ao conjunto compartilhado → privacidade diferencial;


D

os dados podem ser reidentificados através de engenharia reversa do número identificador → randomização não linear dos identificadores;


E

o campos restantes podem ser usados para deduzir informação não inclusa no conjunto de dados → k-anonimato.