Machine Learning / AI
Ako rozdeliť dokumenty na časti? Akú veľkosť časti zvyčajne vyberajú?
Aká je časová zložitosť riešenia v notácii O?
Aké metódy boja s pretrénovaním existujú a ako fungujú?
Ako spojiť údaje z dvoch tabuliek s rôznou úplnosťou adresy a ceny v SQL?
Aké nástroje a knižnice možno použiť pri riešení úloh v Pythone?
Ako zorganizovať detekciu anomálií podľa metrík modelu?
Aká depth stromov sa používa v Random Forest a boosting?
Povedzte nám o Dropout: ako funguje počas tréningu a čo sa s ním deje pri inferencii?
Aká je základná myšlienka za metódami ansámblu? Aké druhy ansámblov poznáte?
Ako riešime problém lineárnej regresie, ak nepoužívame explicitnú formulu?
Povedzte nám o optimalizátore Adam: z čoho pozostáva?
Ako sa zmení ROC AUC pri duplikovaní pozitívnych a negatívnych objektov a prečo?
Ako zjednodušiť riešenie, aby sme prešli zoznam s menším počtom prechodov?
Aký je rozdiel medzi gradient boostingom a náhodným lesom?
Čo je SwiGLU a v akých modeloch sa táto aktivácia používa?
Ako vytvoriť metriku, ktorá zohľadňuje očakávaný zisk a pravdepodobnosť predaja podľa kategórií?
Aký je rozdiel medzi AutoML pre tabuľkové údaje a CV/NLP?
Ako filtrovať iba aktuálne údaje v SQL dopyte?
Čo je stacking a blending?