Machine Learning / AI
Czy kolejność wyodrębnionych fragmentów jest istotna i czy istnieją metryki, które to uwzględniają?
Czym jest Apache Spark i gdzie jest skuteczny w pipeline'ach ML?
Czy znasz JOIN, LEFT JOIN, RIGHT JOIN?
Jakie funkcje są optymalizowane podczas treningu regresji logistycznej?
Jak gradient boosting poprawia wydajność modeli uczenia maszynowego?
Jakie zasoby dotyczące modeli i artykułów monitorujesz?
Jak zrozumiałbyś, dlaczego uczniowie w grupie z systemem rekomendacji przestali wykonywać zalecane zadania?
Jak zorganizowano proces pracy? Skąd pochodziły zadania, jak ustalano terminy?
Kto zajmował się wdrożeniem na produkcję i jakie były metryki sukcesu projektu?
Czym jest uczenie kontrastowe w NLP (SimCSE)?
Czy na rozmowie kwalifikacyjnej z ML mogą zadawać pytania o struktury danych, takie jak drzewa i listy powiązane?
Wymień co najmniej trzy ograniczenia, które warto wziąć pod uwagę, pracując z LLM jako technologią.
Czym jest cross-encoder i gdzie go używałeś?
Jak podoba ci się format pracy — dwa razy w tygodniu w biurze?
FROM python:3.11 COPY ./app WORKDIR /app RUN pip install torch transformers fastapi uvicorn sentence-transformers CMD ["uvicorn", "main:app", "--host", "0.0.0.0"]
Jak znaleźć ostatni zakup na osobę w danych?
Jak można zmodyfikować funkcjonalność błędu?
Czym jest macierz Jordana?
Czy sam to wszystko robiłeś (RAG, LoRA, praca z sieciami neuronowymi), czy pomagałeś komuś?
Opowiedz o parametrach generacji LLM: temperatura, top-k, top-p i inne.