Sobes.tech

Machine Learning / AI

Kannst du den Unterschied zwischen Cross-Encoder und Bi-Encoder erklären?

220

Gibt es eine Möglichkeit zu überprüfen, ob der generierte Text keine faktischen Fehler im Vergleich zum Original enthält?

196

Wie erkennt man, ob ein Embedding-Modell gut funktioniert? Welche Metriken wurden verwendet?

192

Wie wurde die Chunking-Strategie für das RAG-System ausgewählt?

182

Erzähle mir von den Leistungsmetriken des ML-Services: Latenz, RPS, wie wurde das in deinem Projekt organisiert?

180

Wie testet man einen auf FastAPI implementierten Dienst?

180

Wie wurden die Daten aus PDF-Dokumenten für das RAG-System extrahiert?

179

Erzählen Sie mir von vektorbasierten Datenbanken, welche es gibt, worin sie sich unterscheiden, warum haben Sie sich für pgvector entschieden?

166

Erzählen Sie mir von den Parametern der LLM-Generierung: Temperatur, top-k, top-p und andere.

166

Erzähle mir von der Quantisierung von Modellen: Was ist das, wozu ist es gut, welche Arten gibt es?

158

Wie stehen Recall und Precision zueinander, kann man das eine erhöhen, ohne das andere zu verringern? Geben Sie Beispiele für Aufgaben.

149

Wie wurden die Daten für die Zusammenfassung von Dialogen organisiert und wie fand das Training statt?

149

Welche Quantisierungsmethode (int8 oder float) beeinträchtigt die Modellqualität am wenigsten?

147

Wie würdest du die Aufgabe angehen, einen Dialog von mehreren Personen auf einer Konferenz zusammenzufassen (z.B. 10 Entwickler in Slack)?

143

Erzählen Sie mir von der schwierigsten Aufgabe oder Herausforderung in einem der Projekte.

141

Welches Modell und Ansatz wählen Sie für die Verarbeitung von Audio aus einer Konferenz (Sprach-zu-Text, Diarisierung)?

137

Wie arbeitet man mit privaten Daten bei der lokalen Systembereitstellung?

123

Warum wurde die hybride Suche BM25 + Embeddings anstelle des reinen Kosinusabstands gewählt?

118