Sobes.tech
Senior

O que é uma porta dos fundos de etiqueta limpa?

sobes.tech IA

Resposta da IA

Clean-label backdoor — é um tipo de vulnerabilidade oculta em modelos de aprendizagem automática, na qual um comportamento malicioso é inserido no modelo através dos dados de treino, sem alterar as etiquetas visíveis ou a estrutura dos dados.

Ao contrário dos ataques backdoor tradicionais, onde os dados podem estar claramente rotulados ou modificados (por exemplo, adicionando um gatilho com uma etiqueta brilhante), o backdoor de etiqueta limpa usa dados "limpos" com etiquetas corretas, o que dificulta a sua deteção.

Exemplo: um atacante adiciona ao conjunto de treino imagens com um padrão (gatilho) específico, mas as etiquetas dessas imagens correspondem ao seu conteúdo. O modelo é treinado com esses dados e funciona normalmente em condições normais, mas quando o gatilho aparece nos dados de entrada, o modelo comporta-se de forma intencionalmente incorreta.

Isto representa uma ameaça séria à segurança, pois esses backdoors são difíceis de detectar com métodos padrão de verificação de qualidade e integridade do modelo.