Machine Learning / AI
Ako zorganizovať sledovanie modelu v produkcii?
Ako je text predstavený pre neurónovú sieť?
Čo sa stane, ak odstránite strom z boostingu?
V čom sa líši grid search od random search? Kedy je random rýchlejší?
Čo je FastAPI?
Čo je to pseudo-relevance feedback?
Čo je red-teaming LLM modelov?
Čo je p-tuning?
Odkiaľ je známe množstvo údajov?
V čom sa líši viacvláknové spracovanie od viacprocesového spracovania?
Ako rád sa učíš, čítaš? Máš okrem Kaggle aj nejaké vlastné projekty?
Aké spôsoby existujú na zníženie veľkosti modelu pri zachovaní kvality?
Čo je invertný index a aké dátové štruktúry sa používajú?
Aká možnosť je najlepšia na prenos veľkých textových dát (okolo 10 GB)?
Čo je reťazec myslenia (CoT)?
Čo je to partícia v ClickHouse?
Aký je rozdiel medzi doménovým menom a IP adresou ako endpoint?
Ako efektívne vyhľadávať podobné embeddy medzi miliónmi produktov pomocou Faiss alebo iných indexov?
Čo je to diskretizácia (binning) spojitých znakov a na čo slúži?
Aké sú vlastnosti zostavovania dátovej sady a validácie pre modely časových radov?