Was ist der HAVING-Operator in SQL? Wo wird er verwendet?
Machine Learning / AI
Regressionsaufgabe: Vorhersage des Aktienkurses im 5. Jahr anhand der Daten der 4 vorherigen Jahre mit Boosting. Welchen Fehler haben wir gemacht?
Was sind die MAPE- und SMAPE-Metriken? Wo könnten sie ineffektiv sein?
Erzählen Sie uns vom Projekt zur Bewertung der Qualität der Arbeit von Dispatchern: Welche Modelle wurden verwendet, wie wurden sie mit dem Referenzskript verglichen?
Warum CatBoost und nicht XGBoost oder LightGBM? Was sind die Unterschiede?
Erzählen Sie uns vom Projekt der Clusterbildung von Anfragen mit Markierung nach geschäftlicher Bedeutung.
MVP-Aufgabe: Binäre Klassifikation mit Klassenungleichgewicht, die Daten sind auf 10 Maschinen verteilt, es gibt eine Textfunktion. Welchen Ansatz schlagen Sie vor?
Welche Metriken sind bei einem großen Klassenungleichgewicht (99 zu 1) am wichtigsten?
Kennen Sie die Protokolle HTTP, UDP, TLS?
Was ist der Hauptunterschied zwischen Spark und Pandas? Was ist Hadoop?
Weißt du, was Bagging ist? Gib ein Beispiel für einen Algorithmus.
Erzählen Sie vom K-means-Algorithmus und seinen erweiterten Varianten (K-means++).
Was ist LoRA (Low-Rank Adaptation)?
Erzählen Sie mir etwas über sich, Ihre Erfahrungen und Projekte.
Erzählen Sie mir mehr über das Projekt zur Vorhersage der Mitarbeiterfluktuation: Was haben Sie gemacht, welche Daten verwendet, warum haben Sie sich für CatBoost entschieden?
Welche Metriken werden zur Bewertung der Clusterqualität verwendet? Wie wählt man die Anzahl der Cluster aus?