Machine Learning / AI
Írja le a szomszédos számok tartományokra való csoportosításának feladatát.
Hogyan számoljuk ki a mintanagyságot egy A/B teszthez?
Milyen típusú modelleket ismer az észlelési feladatokhoz (R-CNN család, YOLO, SSD, DETR)?
Mi a generatív molekulamodellek?
Hogyan alakítsunk ki olyan metrikát, amely figyelembe veszi a profit várakozást és az értékesítési valószínűséget kategóriánként?
Milyen regularizációs módszerek léteznek nemlineáris modellekhez?
Mi az a lazy számítás a Spark-ben?
Hogyan tanítjuk a modellt? Írja le a súlyfrissítési algoritmust.
Mi az a Thompson mintavétel és az UCB?
Mi az a beam search és miért használják ritkán nyílt végű generáláshoz?
Hogyan döntjük el a veszteségfüggvény kiválasztását a modellhez az üzleti és adatok szempontjából?
Mi az a masked autoencoders (MAE) a CV-hez?
Mi az az OSM és hogyan lehet belőle címkéket kinyerni?
Hogyan növelhető a sebesség a teszten anélkül, hogy újra tanítanánk a modellt?
Mi az NSP (következő mondat előrejelzése), és miért hagyta el a RoBERTa?
Mi a különbség az NDCG és az Accuracy metrikák között? Melyik fontosabb a hírcsatornához?
Hogyan készítsük el a tényezők binárisítását, például az életkort?
Milyen módszerek használhatók képgenerálásra (GAN, VAE, diffúziós, autoregresszív)? Minden módszer előnyei és hátrányai.
Mi a különbség a top-k és a top-p (mag) mintavétel között?
Hogyan kell egy ügynöknek nagyon nagy eszközsémával (funkciók kiválasztása) dolgoznia?