Machine Learning / AI
Czym różni się DiT (Diffusion Transformer) od U-Net w dyfuzji?
Jak lubisz się uczyć, czytać? Masz jakieś projekty prywatne oprócz Kaggle?
Czym jest popularność-bayas i jak z nią walczyć?
Czym jest HyDE (Hypothetical Document Embeddings)?
Jakie biblioteki używać do wyszukiwania najbliższych sąsiadów?
Opowiedz o zadaniu tłumaczenia maszynowego. Czym jest sequence-to-sequence?
Co oznaczają składniki TF i IDF?
Opisz zadanie grupowania sąsiednich liczb w zakresy.
Jak obliczyć rozmiar próbki dla testu A/B?
Jakie typy modeli znasz do zadań detekcji (rodzina R-CNN, YOLO, SSD, DETR)?
Czym są modele generatywne molekuł?
Jak tworzyć metrykę uwzględniającą oczekiwanie zysku i prawdopodobieństwo sprzedaży według kategorii?
Jakie rozwiązania podjąć w przypadku braku zasobów do obsługi opóźnionych żądań?
Jakie metody regularyzacji istnieją dla modeli nieliniowych?
Czym są opóźnione obliczenia w Spark?
Jak trenować model? Opisz algorytm aktualizacji wag.
Czym są próbkowanie Thompsona i UCB?
Czym jest wyszukiwanie wiązkowe i dlaczego jest rzadko używane do generacji otwartej?
Jak podjąć decyzję o funkcji straty dla modelu z punktu widzenia biznesu i danych?
Czym jest OSM i jak z niego wyciągać etykiety?