Machine Learning / AI
Koje ste još boostinge probali osim CatBoost?
Kako biste automatizovali deljenje na delove pri volumenu podataka od 10 gigabajta?
Šta je Apache Beam / Dataflow?
Šta je Field-aware FM (FFM)?
Zašto je potreban Spark i kako radi?
Šta je system prompt i kako ga pravilno koristiti?
Kako osigurati relevantnost informacija u RAG sistemu pri stalnom ažuriranju dokumenata?
Да ли имате тим аналитичара?
Ispričajte slučaj kada je model dobro radio tokom offline procene, ali je loše radio u produkciji: šta se dogodilo i šta ste uradili?
Kako rangirati izdvojene delove po relevantnosti za upit?
Ispričajte mi o Random Forest: mehanika učenja, kako se formiraju stabla, kako se vrši predviđanje za zadatke klasifikacije?
Koja je razlika između GET i POST zahteva?
Kako dobiti embedding velikog teksta (npr. dugog opisa proizvoda) za zadatak klasifikacije?
Шта учинити на крају обуке?
Kako još možemo proceniti agenta osim LLM-as-a-Judge: kojim kriterijumima shvatiti da radi ispravno ili blizu ispravnog?
Sa kojim drugim iskustvom u NLP ste radili, sa kojim zadacima?
Šta je ROC AUC? Kako se gradi ROC kriva?
Да ли имате искуство са системима за препоруке?
Zašto napuštate svoje trenutno radno mesto?
Da li su podaci čuvani u obliku ravne tabele? Da li si sam razvio funkcije ili ih je neko drugi uradio za tebe?