Machine Learning / AI
Milyen típusú modelleket ismer az észlelési feladatokhoz (R-CNN család, YOLO, SSD, DETR)?
Mi az a differenciális adatvédelem és a DP-SGD?
Mi a különbség a NaN és a None között Pythonban?
Hogyan szervezzük a konténerizálást és a modellek telepítését?
Hogyan egyensúlyozzuk a modell válaszsebességét és a modell méretét?
Mi a különbség az NDCG és az Accuracy metrikák között? Melyik fontosabb a hírcsatornához?
Mi a különbség a top-k és a top-p (mag) mintavétel között?
Hogyan egyesíted két adatbázis adatait egy egységes modellbe, például egy hópehely vagy csillag formájában?
Milyen buktatók vannak az AutoML használatakor a termelésben (újrahasznosíthatóság)?
Hogyan használjuk az Airflow-t az ETL folyamatok szervezésére?
Mi a ROC-AUC valószínűségi értelmezése?
Hogyan számoljuk ki az életkort években a jelenlegi dátum és a születési dátum között Pythonban?
Mi az első és második típusú hibák?
Mi az a feature store és milyen feladatokat old meg (Feast, Tecton)?
Milyen szöveg felismerő modellek (CRNN, TrOCR)?
Mi az a jelöltgenerálás és milyen megközelítések vannak (BM25, dense, hybrid)?
Milyen jellemzői vannak a címke zajtűrő tanulásnak?
Mit tegyünk, ha a modell nem fér bele a GPU-ba további tanítás során?
Milyen okok vezethetnek ahhoz, hogy különböző elemzők különböző értékeket adjanak egy webszolgáltatás átlagos napi látogatottságára?
Mi az a népszerűség-bayas és hogyan küzdjünk ellene?