Sobes.tech

Python

Kann es in asynchronem Python-Code zu einem Race Condition kommen?

202

Wie viele Dokumente wurden bei der Suche abgerufen? Gab es ein Re-Ranking?

186

Wie funktionierte der semantische Cache in Redis?

164

Wie wurde die Qualität der Arbeit des RAG-Systems bewertet?

163

Wie haben Sie den Betrieb des Dienstes überwacht? Was haben Sie in Grafana angesehen?

155

Was kann noch im predict-Methoden optimiert werden? (Erstellung des DataFrame jedes Mal)

142

Warum ist es besser, POST anstelle von GET für diesen Endpunkt zu verwenden?

139

Einen Web-Service in FastAPI schreiben, der eine POST-Anfrage mit Daten (Einkommen, Alter, Kreditbetrag) entgegennimmt und die Vorhersage des ML-Modells (Kreditgenehmigung) zurückgibt

138

Wie optimiert man den Service, damit eine synchrone CPU-Aufgabe (Vorhersagemodell) die Event Loop von FastAPI nicht blockiert?

137

Erzählen Sie mir den gesamten Pipeline des RAG-Systems: Welche Dokumente wurden verwendet, wie wurden sie geladen und verarbeitet?

133

Was ist Singleton und wie wird es zur Modellladung angewendet? Welche Nachteile hat Singleton?

133

Wie lange hat die gesamte RAG-Pipeline von der Anfrage bis zur Antwort gedauert?

125

Wie wurden die Dokumente in die Vektor-Datenbank geladen? Wie erfolgte das Chunking?

116

Welches Problem tritt auf und wie kann man es lösen, wenn in einem asynchronen Dienst ein lokales ML-Modell (z.B. ein Reranker) verwendet wird, das synchron aufgerufen wird?

114

Wie wurden die Embeddings erstellt? Mit welchem Modell und wie wurde es gestartet?

109

Wie funktioniert Multithreading in Python unter Berücksichtigung des GIL? Worin unterscheiden sich Threads von Prozessen?

106