Machine Learning / AI
Welche Hyperparameter von HNSW sind wichtig (M, efConstruction, efSearch)?
Erzählen Sie uns von XLM-R und multilingualem NLP.
Was machen wir mit den Daten, um den Unterschied zwischen den Modellen im Bagging zu erhalten?
Wie lernst du gerne, liest du gerne? Hast du neben Kaggle eigene Projekte?
Was ist der Unterschied zwischen Boosting und Bagging (Random Forest)? Vergleichen Sie ihre Neigung zur Überanpassung.
Was ist Bildbeschriftung und welche Metriken bewerten sie (CIDEr)?
Welche Möglichkeiten gibt es, die Modellgröße bei gleichbleibender Qualität zu verringern?
Welche Merkmale haben OTA-Updates von Modellen in mobilen Anwendungen?
Wie trainiert man LoRA für Stable Diffusion?
Was ist Daten-Drift?
Wie findet man effizient ähnliche Embeddings unter Millionen von Produkten mit Faiss oder anderen Indizes?
Wie erhält man in Spark das Alter in Bins basierend auf dem Geburtsdatum an einem bestimmten Datum?
Was ist DBT und wie passt es zu ML?
Was ist Diskretisierung (Binning) von kontinuierlichen Merkmalen und wozu dient sie?
Was ist ein adversariales Beispiel und ein FGSM-Angriff?
Was ist GELU und warum ist es besser als ReLU in Transformatoren?
Warum muss die LEAD-Funktion verwendet werden, um zukünftige Werte nach id in SQL zu suchen?
Warum werden in Python-Modulen die Dateien __init__.py erstellt?
Wie wählt man Daten zur Schätzung des Medians aus: sequentielle Durchläufe oder zufällige Teilstichproben?
Was ist Expert Routing und welche Methoden der Lastverteilung zwischen Experten gibt es?