Machine Learning / AI
Ako spustiť veľký model na slabom hardvéri?
Aké metriky sa používajú na segmentáciu a detekciu objektov?
Vytvárali ste rešitve za stranke zamestnávateľa — brali so ich inštalovali a sami vzdržovali?
Ako BERT zachytáva sémantickú podobnosť medzi vetami napísanými odlišne, ale majúcimi rovnaký význam?
Ako vypočítať kosínusovú podobnosť medzi otázkami?
Čo sa stane, ak na fáze validácie nevoláte model.eval()?
Prečo BERT dosahuje lepšiu kvalitu v úlohách klasifikácie textu ako TF-IDF s logistickou regresiou?
Ako vytvoriť a natrénovať klasifikátor v PyTorch?
Ako funguje tokenizácia? Prečo sa používajú subword tokeny namiesto celých slov?
Prečo používať zoznamy na uloženie predchádzajúcich hodnôt?
Čo je to kosínus v porovnaní s skalárnym súčinom a euklidovskou vzdialenosťou — ako ovplyvňuje normalizácia?
Ako trénovať na veľkom dávke s obmedzenou pamäťou?
Ako pracovať s neúplnými údajmi z rôznych serverov a tabuliek?
Bol vykonaný dropout na základe straty alebo náhodného vyraďovania váh?
Povedzte mi o vašich skúsenostiach s analýzou dát, projekty a kurzy.
Čo je BatchNorm?
Čo je LOF (Lokálny faktor odľahlosti)?
Ako organizovať ukladanie dát s ohľadom na údaje z viacerých zdrojov: backend databáza, klikstream, CRM a komunikácie?
Ako optimalizovať inference?
Čo môže ísť zle v modeli?