Was ist die Kontextlänge und warum ist es schwierig, sie zu erweitern?
Machine Learning / AI
Welche Prompt-Komprimierungstechniken kennen Sie (LLMLingua)?
Was ist Überanpassung und wie bekämpft man sie?
Was sind die Ursachen des Überanpassens?
Welche Methoden können zur Verbesserung des Modells verwendet werden?
Wie bewertet man die mediane Antwortzeit eines Dienstes bei großem Log-Volumen, das nicht in den Speicher passt?
Wie wählt man Daten zur Schätzung des Medians aus: sequentielle Durchläufe oder zufällige Teilstichproben?
Was ist Autokorrelation und partielle Autokorrelation (ACF, PACF)?
Welche Arten der Regularisierung gibt es und wie funktionieren sie?
Was ist ein Experience Replay Buffer und wozu dient er?
Warum können die Gewichte des Modells groß werden und warum ist es notwendig, sie durch Regularisierung zu verringern?
Was ist Medusa und Multi-Token-Vorhersageköpfe?
Was ist die Visualisierung des Feature-Raums eines CV-Modells mit t-SNE/UMAP?
Wie organisiert man die Containerisierung und das Deployment von Modellen?
Was ist Kalibrierung und warum ist sie wichtig für Fairness?
Welche Arten von Fehlern gibt es in medizinischen Protokollen und wie werden sie typisiert?
Welche Methoden gibt es gegen Überanpassung und wie funktionieren sie?
Was ist eine Skip-Verbindung und wozu dient sie (ResNet)?
Was ist der Unterschied zwischen MobileNet v2 und v1 (invertierte Residuen)?
Erzählen Sie mir von der Aufgabe der maschinellen Übersetzung. Was ist sequence-to-sequence?