Sobes.tech

Python

Czy w asynchronicznym kodzie Pythona może wystąpić race condition?

202

Ile dokumentów odzyskano podczas wyszukiwania? Czy był re-ranking?

186

Jak działała semantyczna pamięć podręczna w Redis?

164

Jak monitorowałeś pracę usługi? Co oglądałeś w Grafana?

155

Co jeszcze można zoptymalizować w metodzie predict? (tworzenie DataFrame za każdym razem)

142

Dlaczego lepiej używać POST zamiast GET dla tego endpointu?

139

Napisać serwis internetowy w FastAPI, który przyjmuje żądanie POST z danymi (dochód, wiek, kwota kredytu) i zwraca prognozę modelu ML (zatwierdzenie kredytu)

138

Jak zoptymalizować usługę, aby synchroniczne zadanie CPU (model predykcyjny) nie blokowało pętli zdarzeń FastAPI?

137

Opowiedz mi o całym pipeline systemu RAG: jakie dokumenty były używane, jak były ładowane i przetwarzane?

133

Czym jest Singleton i jak go zastosować do ładowania modelu? Jakie są wady Singleton?

133

Ile czasu zajęła cała linia RAG od zapytania do odpowiedzi?

125

Jak dokumenty były ładowane do bazy danych wektorowej? Jak przebiegało chunkowanie?

116

Jaki problem się pojawia i jak go rozwiązać, jeśli w asynchronicznej usłudze używany jest lokalny model ML (np. reranker), który jest wywoływany synchronicznie?

113

Jak uzyskiwano osadzenia? Za pomocą jakiego modelu i jak był uruchamiany?

108

Jak działa wielowątkowość w Pythonie z uwzględnieniem GIL? Czym różnią się wątki od procesów?

106