Machine Learning / AI
Welche drei Matrizen werden in der Multi-Head-Attention verwendet?
Wie kann man ResNet50 bei einer Klassifikationsaufgabe vereinfachen?
Wie kann man die Menge der Trainingsdaten bei einer geringen Anzahl an annotierten Objekten erhöhen?
Was geben aggregierte und nicht aggregierte Funktionen in einer SQL-Abfrage zurück?
Was ist Key Padding Mask vs Attention Mask in PyTorch?
Was ist Aufmerksamkeit?
Welche Arten der Modell-Destillation gibt es?
Welche praktischen Tricks beschleunigen die Inferenz von Transformatoren (spekulative Decodierung, Medusa)?
Wie erkennt man Text in Bildern mit NLP?
Wie implementiert man einen Algorithmus zum Zählen und Verschieben von Nullen in einem Array in Python?
In welchen Fällen muss man Backbones auswählen und wann kann man ResNet50 verwenden?
Was ist Destillation?
Was ist der Unterschied zwischen level-wise und leaf-wise Baumtraining?
Was ist eine Partition in ClickHouse?
Sollte man shuffle im DataLoader verwenden?
Welche Fehler im Trainingszyklus können das Lernen und die Qualität des Modells verschlechtern?
Was ist EfficientNet und zusammengesetztes Scaling?
Was ist eine heterogene GNN und wo werden sie eingesetzt?