Machine Learning / AI
Was ist FLUX und was ist seine Idee?
Kann man frühere Interaktionen mit dem Kunden in den Metriken des Uplift-Modells berücksichtigen?
Möchten Sie 100 % Ihrer Zeit mit Programmieren verbringen oder bevorzugen Sie ein anderes Verhältnis?
An welchem Projekt haben Sie an der Bereitstellung von Diensten und der Entwicklung von FastAPI-Diensten gearbeitet: Haben Sie das selbst umgesetzt oder nur gewartet und überwacht?
Was sind Bayesian Neural Networks und wie berechnet man den Posterior?
Was unterscheidet None in Python, NaN in NumPy und NA in Pandas?
Warum neigt die L1-Regularisierung dazu, die Gewichte auf null zu setzen, während die L2-Regularisierung dies nicht tut? Wie lässt sich das mathematisch herleiten?
Können Sie genauer erklären, wie genau der Antigradient berechnet wird und wie er zur Konstruktion des nächsten Baumes verwendet wird?
Wie organisiert man eine Kontrollgruppe (Stichprobe) in Risikomodellen?
Betrachtest du ein Bruttogehalt von 300.000?
Erzählen Sie uns von Ihrer Erfahrung im Projektmanagement im Sport.
Warum ist Datenaugmentation notwendig?
Was sind Anserini und Pyserini?
Worin besteht der Unterschied zwischen Funktionsaufruf und klassischem Few-Shot-Prompting für eine strukturierte Ausgabe?
Erklären Sie in wenigen Worten, wie sich der Double Robust-Ansatz vom IPS unterscheidet — was hinzugefügt wird und was ihn stärker und widerstandsfähiger macht?
Was ist PR-AUC vs ROC-AUC bei extremem Ungleichgewicht?
Was ist eine Beratungs-Sperre?
Welche Schlüssel-Hyperparameter des Gradient Boosting können Sie nennen?
Was sind die Unterschiede zwischen Dense- und MoE-Modellen, zum Beispiel Qwen3-27B und Qwen3-30B-A3B?
Wenn die Batch-Größe größer ist, wird der Gradient kleiner oder größer?