Kannst du den Unterschied zwischen Cross-Encoder und Bi-Encoder erklären?
Machine Learning / AI
Gibt es eine Möglichkeit zu überprüfen, ob der generierte Text keine faktischen Fehler im Vergleich zum Original enthält?
Wie erkennt man, ob ein Embedding-Modell gut funktioniert? Welche Metriken wurden verwendet?
Wie wurde die Chunking-Strategie für das RAG-System ausgewählt?
Erzähle mir von den Leistungsmetriken des ML-Services: Latenz, RPS, wie wurde das in deinem Projekt organisiert?
Wie testet man einen auf FastAPI implementierten Dienst?
Wie wurden die Daten aus PDF-Dokumenten für das RAG-System extrahiert?
Erzählen Sie mir von vektorbasierten Datenbanken, welche es gibt, worin sie sich unterscheiden, warum haben Sie sich für pgvector entschieden?
Erzählen Sie mir von den Parametern der LLM-Generierung: Temperatur, top-k, top-p und andere.
Erzähle mir von der Quantisierung von Modellen: Was ist das, wozu ist es gut, welche Arten gibt es?
Wie stehen Recall und Precision zueinander, kann man das eine erhöhen, ohne das andere zu verringern? Geben Sie Beispiele für Aufgaben.
Wie wurden die Daten für die Zusammenfassung von Dialogen organisiert und wie fand das Training statt?
Welche Quantisierungsmethode (int8 oder float) beeinträchtigt die Modellqualität am wenigsten?
Wie bewertet man die Qualität der Zusammenfassung?
Wie würdest du die Aufgabe angehen, einen Dialog von mehreren Personen auf einer Konferenz zusammenzufassen (z.B. 10 Entwickler in Slack)?
Erzählen Sie mir von der schwierigsten Aufgabe oder Herausforderung in einem der Projekte.
Welches Modell und Ansatz wählen Sie für die Verarbeitung von Audio aus einer Konferenz (Sprach-zu-Text, Diarisierung)?
Erzähl mir von LoRA: Was ist das, wofür ist es?
Wie arbeitet man mit privaten Daten bei der lokalen Systembereitstellung?
Warum wurde die hybride Suche BM25 + Embeddings anstelle des reinen Kosinusabstands gewählt?