Kas ir clean-label backdoor?
sobes.tech AI
Atbilde no AI
Clean-label backdoor — tas ir slēpts ievainojamības veids mašīnmācīšanās modeļos, kur ļaunprātīga uzvedība tiek ieviesta modelī caur apmācības datiem, nemainot redzamos marķierus vai datu struktūru.
Atšķirībā no tradicionālajām backdoor uzbrukumiem, kuros dati var būt skaidri marķēti vai mainīti (piemēram, pievienojot triggeri ar spilgtu marķieri), clean-label backdoor izmanto "tīrus" datus ar pareiziem marķieriem, kas apgrūtina to atklāšanu.
Piemērs: uzbrucējs pievieno apmācību kopai attēlus ar noteiktu rakstu (triggeri), bet šo attēlu marķieri atbilst to saturam. Modelis tiek apmācīts uz šiem datiem un parasti darbojas pareizi, bet, parādoties triggerim ievades datos, modelis uzvedas apzināti nepareizi.
Tas ir nopietns drošības drauds, jo šādus backdoor ir grūti atklāt ar standarta kvalitātes un integritātes pārbaudes metodēm.