Cum să implementați tehnic un sistem de stocare a datelor și alerte pentru monitorizarea modelului?
Machine Learning / AI
Ai idei pentru îmbunătățirea în continuare a sistemului de prognoză a cererii?
Cum sunt similare și diferite pădurea aleatorie și boostingul de gradient? Cum sunt construite copacii în fiecare?
Cum ai determinat calitatea clustering-ului? Ce metode ai folosit?
Spune cum funcționa algoritmul de clustering pe care l-ai folosit — cum a agregat punctele în spațiu?
Referitor la Spark — ce sarcini specifice au fost paralelizate pe el?
Ce este o serie temporală stationară, cum o verifici și de ce este importantă?
Care este diferența dintre un interval de încredere și un interval de predicție? Ce arată acestea?
Cum să construiți un sistem pentru urmărirea calității și luarea deciziilor privind înlocuirea modelului?
Caz: dezvoltarea unui sistem de tarifare pentru clasa business S7. 300 de zboruri pe zi, ~100 cu clasa business, 4-6 locuri. Două obiective: ocupare maximă și venit maxim. Prețurile sunt actualizate zilnic și după fiecare achiziție. În prezent, prețurile sunt stabilite manual, în funcție de ocupare. Cum ai aborda această sarcină?
Spune despre cazuri interesante de optimizare în Spark legate de caracteristici și join-uri complexe
Ce modele ai folosit pentru previzionarea cererii?
Cum să rezolvi problema datelor istorice deplasate (prețurile au fost subevaluate, modelul vede slab cererea la niveluri noi)?
Spune-ne despre experiența ta în Data Science
Cum să gestionezi un volum scăzut de feedback pe rute liniștite (puține zboruri, date zgomotoase)?