Machine Learning / AI
Mi az a Név Entitás Felismerés (NER)? Melyik jelölés a leggyakoribb (BIO, BIOES)?
Milyen adatstruktúra áll a Python dict alapjaiban? Hogyan oldják meg az ütközéseket?
Előfordul-e modelloválás dropout alkalmazásával történő tanítás és nélküle történő inferencia során?
Mit tegyünk az adathalmazzal a modell tanítása előtt?
Hogyan kódoljuk helyesen a ciklikus jellemzőket?
Milyen jellemzők kiválasztási módszerek léteznek?
A korrelációs együttható 0. Megállapíthatjuk, hogy a minták függetlenek? Miért?
Használható-e a (1, [1, 2]) kulcsként egy Python szótárban? Miért?
Mi az a depthwise separable convolution és hol alkalmazzák (MobileNet)?
Mi az a disparitás hatás?
Mesélj a magyar algoritmusról. Hol használják az ML-ben?
Mi az a bagging és miért csökkenti a modell varianciáját?
Mi az adatverziózás és összehasonlítás a DVC, LakeFS, lakeFS között?
Mi az a Faiss és hogyan működik?
Meg tudnád magyarázni a különbséget a cross-encoder és a bi-encoder között?
Dolgozott már Apache Spark-kal?
Mi az a knowledge graph és hol alkalmazzák?
Milyen szerepek voltak a csapatban?
Milyen sorrendben soroljuk fel az index mezőit dátum, azonosító és logikai mező szerint történő összekapcsolás esetén?
Rossz dolog az összes mező indexelése, és miért?