Machine Learning / AI
Czym jest re-ranker w RAG? Jakie modele używają (cross-encoder, bge-reranker)?
Czym różni się coco mAP od Pascal VOC mAP?
Czy masz doświadczenie w projektowaniu i wdrażaniu złożonych architektur sieci neuronowych (transformery, RNN)?
Czym jest data drift i concept drift?
Jak działa wczesne zatrzymanie w drzewach?
Czym różni się WordPiece od BPE na poziomie wyboru pary do scalania?
Jakie są problemy bezpieczeństwa z agentami mającymi dostęp do systemu plików / shell?
Jak przygotowałeś dokumenty do RAG (chunking, embeddings, Milvus)?
Jak szukać i naprawiać problemy w danych z interwałami czasowymi i wartościami domyślnymi?
Czym jest GraphSAGE i dlaczego potrzebne jest próbkowanie sąsiadów?
Czym jest boundary loss i do czego jest potrzebny?
Jak uwzględnić przypadki z zerami w iloczynie elementów listy?
Czym są bazy danych kolumnowe i dlaczego są lepsze do analizy?
Jakie są metody pracy z cechami kategorycznymi?
Jaka jest złożoność proponowanego rozwiązania z usuwaniem znaków i odwracaniem? Czy można ulepszyć algorytm?
Opowiedz o metodach regularyzacji i walki z przeuczeniem w Deep Learning (Dropout, Batch Normalization, Early Stopping, Elastic Net).
Czym jest normalizacja długości dokumentu?
Jak znaleźć w ciągu największą liczbę całkowitą bez użycia wyrażeń regularnych w Pythonie?
Czym różni się Word2Vec od Bag of Words?
Do czego służy warstwa pooling?