Τι είναι ο τελεστής HAVING στο SQL; Πού χρησιμοποιείται;
Machine Learning / AI
Πρόβλημα παλινδρόμησης: πρόβλεψη της τιμής των μετοχών στο 5ο έτος χρησιμοποιώντας δεδομένα 4 ετών με boosting. Ποιο λάθος κάναμε;
Τι είναι τα metrics MAPE και SMAPE; Πού μπορεί να είναι αναποτελεσματικά;
Πείτε μας για το έργο αξιολόγησης της ποιότητας εργασίας των διαχειριστών: ποια μοντέλα χρησιμοποιήθηκαν, πώς συγκρίθηκαν με το πρότυπο σενάριο;
Γιατί CatBoost και όχι XGBoost ή LightGBM; Ποιες είναι οι διαφορές;
Καθήκον MVP: δυαδική ταξινόμηση με ανισορροπία κλάσεων, τα δεδομένα διανέμονται σε 10 μηχανές, υπάρχει μια χαρακτηριστική κειμένου. Ποια προσέγγιση θα προτείνατε;
Αναφέρετε το έργο ομαδοποίησης αιτημάτων με επισήμανση κατά επιχειρηματική σημασία.
Ποια μετρική είναι η πιο σημαντική σε περίπτωση μεγάλης ανισορροπίας των κλάσεων (99 προς 1);
Ξέρετε τα πρωτόκολλα HTTP, UDP, TLS;
Ποια είναι η βασική διαφορά μεταξύ Spark και Pandas; Τι είναι το Hadoop;
Ξέρετε τι είναι το bagging; Δώστε ένα παράδειγμα αλγορίθμου.
Τι είναι το LoRA (Low-Rank Adaptation);
Πες μου περισσότερα για το έργο πρόβλεψης αποχώρησης εργαζομένων: τι κάνατε, ποια δεδομένα χρησιμοποιήσατε, γιατί επιλέξατε το CatBoost;
Πείτε μας για τον αλγόριθμο K-means και τις προχωρημένες του εκδοχές (K-means++).
Πείτε μας για τον εαυτό σας, την εμπειρία και τα έργα σας.
Ποιες μετρήσεις χρησιμοποιούνται για την αξιολόγηση της ποιότητας της ομαδοποίησης; Πώς επιλέγουμε τον αριθμό των ομάδων;