Machine Learning / AI
Koje metrike poznaješ za ocenu LLM sistema u celini?
Ispričaj o svojim projektima: šta si tačno radio, tehnički detaljno?
Koje metode treba koristiti za automatski prevod vrednosti metrika u insights?
Šta je trening zasnovan na populaciji (PBT)?
Kako ćemo podešavati parametre u gradient boostingu? Koji parametri postoje i šta ćeš prvo podešavati?
Da li ste radili sa Airflow ili Spark? Ispričajte, šta je DAG u Airflow, možete li navesti primer iz svog iskustva? Da li ste sami pisali DAG-ove ili ste ih samo koristili/pokretali?
Zašto je potrebno podeliti tipove podataka na promenljive i nepromenljive?
Kako klasifikovati starost po intervalima od 5 godina?
Šta su dimenzije sa sporim promenama (SCD) i kako utiču na ML-fiče?
Koliko težina se trenira u sloju konvolucije sa jezgrom 5x5 i 10 filtera?
Šta je CV-leak i koji su njegovi izvori?
Koji alat je korišćen za strukturalno chunkovanje dokumenata?
Koje konkretne implementacije boostinga poznajete ili s kojima ste radili?
Kako se mogu odabrati hiperparametri?
Šta je ETL?
Да ли тренутно имаш понуде/пре-понуде у руци? Колико активно разматраш предлоге?
Опишите процес одабира карактеристика помоћу одлучу дрвећа.
Šta je aproksimacija srednjeg polja?
Koje su karakteristike kolekcije oznaka (crowdsourcing, aktivno učenje)?
Због чега су трансформери добили предност?