Wie Text vorverarbeiten: Welche Stopwörter und Interpunktion entfernen, Stemming oder Lemmatisierung verwenden?
Machine Learning / AI
Was ist pseudo-relevanz-Feedback?
Was ist das Langzeitgedächtnis des Agenten und wie baut man es auf (Zusammenfassung, Vektorspeicher)?
Was ist Layout-Analyse in Dokumenten?
Wie verläuft das Onboarding und die Schulung neuer Mitarbeiter im Projekt?
Was ist Cross-Modal-Retrieval?
Was ist GPTQ und welcher Ansatz wird bei der Auswahl der Gewichte verfolgt?
Wie arbeitet man mit unvollständigen Daten aus verschiedenen Servern und Tabellen?
Was ist global average pooling und warum ersetzt es die vollverbundene Schicht?
Wie man klassisches maschinelles Lernen zur Verbesserung der Produkterkennung einsetzt?
Wie man die Zusammenführung von zwei sortierten Arrays in ein sortiertes Array implementiert?
Gibt es Daten zur Überprüfung der Lösung oder muss man Testdaten selbst erstellen?
Was ist ein Graph und wie wird er für neuronale Netze dargestellt (Adjazenzmatrix, Kantenliste)?
Welche spezifischen Optimierungen für ARM (NEON)?
Warum kann man einen Entscheidungsbaum für die Klassifikation verwenden?
Wie verbindet man Quittungen mit Produkten bei unvollständigen Daten?
Was ist ein Markov-Entscheidungsprozess (MDP) und welche Komponenten hat er?
Was ist eine Bounding Box und welche Koordinatenformate gibt es (xyxy, xywh, cxcywh)?
Gibt es Analysten, die sich mit dem Daten-Download und der Vorbereitung von Schaufenstern beschäftigen?
Was ist gemeinsam genutzter Speicher und warum sollte man ihn verwenden?