Was ist ein OOV-Token und wie geht die Subword-Tokenisierung damit um?
Machine Learning / AI
Worin besteht der Unterschied zwischen Stemming und Lemmatisierung? Wann sollte man welche anwenden?
Wie man die Inferenz von LLM auf GPU profiliert (nsight, torch profiler)?
Welche Risiken birgt AutoML hinsichtlich der Interpretierbarkeit?
Was sind multispektrale und hyperspektrale Aufnahmen?
Was sind Multi-Armed Bandits und wo man sie anstelle von A/B-Tests einsetzen sollte?
Freitag, es sind noch 2,5 Stunden bis zum Ende des Arbeitstages. Ein Geschäftskunde kommt und sagt, dass am Montag um 9:30 Uhr ein Treffen ist und eine Aufgabe erledigt werden muss, die 5-6 Stunden dauert. Was wirst du tun?
Was ist Redaction und Tokenisierung von PII in Datensätzen?
Fragen des Kandidaten zum Arbeitsformat und Team.
Was ist MIG (Multi-Instance GPU) auf A100/H100?
Was ist Medusa und Multi-Token-Vorhersageköpfe?
Was ist ein Token und worin unterscheiden sich die Tokenisierung auf Zeichen-, Wort- und Subwort-Ebene?
Was ist die Mean-Field-Approximation?
Wurden die Daten in Form einer Flachtabelle gespeichert? Hast du die Funktionen selbst entwickelt oder hat sie jemand anderes für dich gemacht?
Was ist ein gezielter vs. ungezielter Angriff?
Welche Probleme treten bei der Prognose instabiler Reihen (Cold-Start von Produkten) auf?
Was ist ein Confounder und wie berücksichtigt man ihn?
Was ist Video-Objektssegmentierung und Maskenverfolgung (XMem, SAM2)?
Was ist der Unterschied zwischen Sparse Retrieval (BM25) und Dense?
Was sind Meta-Learner (S-learner, T-learner, X-learner, R-learner)?