O que é uma porta dos fundos de etiqueta limpa?
sobes.tech IA
Resposta da IA
Clean-label backdoor — é um tipo de vulnerabilidade oculta em modelos de aprendizagem automática, na qual um comportamento malicioso é inserido no modelo através dos dados de treino, sem alterar as etiquetas visíveis ou a estrutura dos dados.
Ao contrário dos ataques backdoor tradicionais, onde os dados podem estar claramente rotulados ou modificados (por exemplo, adicionando um gatilho com uma etiqueta brilhante), o backdoor de etiqueta limpa usa dados "limpos" com etiquetas corretas, o que dificulta a sua deteção.
Exemplo: um atacante adiciona ao conjunto de treino imagens com um padrão (gatilho) específico, mas as etiquetas dessas imagens correspondem ao seu conteúdo. O modelo é treinado com esses dados e funciona normalmente em condições normais, mas quando o gatilho aparece nos dados de entrada, o modelo comporta-se de forma intencionalmente incorreta.
Isto representa uma ameaça séria à segurança, pois esses backdoors são difíceis de detectar com métodos padrão de verificação de qualidade e integridade do modelo.