Sobes.tech

Python

Môže dôjsť k súťažnej podmienke v asynchrónnom kóde Python?

204

Koľko dokumentov bolo získaných pri vyhľadávaní? Bol re-ranking?

186

Ako bola hodnotená kvalita práce systému RAG?

163

Ako ste sledovali fungovanie služby? Čo ste pozerali v Grafana?

155

Čo ešte možno optimalizovať v metóde predict? (vytváranie DataFrame pri každom volaní)

143

Prečo je lepšie použiť POST namiesto GET pre tento endpoint?

139

Napíšte webovú službu na FastAPI, ktorá prijíma POST požiadavku s údajmi (príjem, vek, výška úveru) a vracia predpoveď ML modelu (schválenie úveru)

138

Ako optimalizovať službu, aby synchronná CPU úloha (model predikcie) ne blokovala event loop FastAPI?

137

Povedaj mi celý pipeline RAG systému: aké dokumenty boli použité, ako boli načítané a spracované?

133

Čo je Singleton a ako ho použiť na načítanie modelu? Aké sú nevýhody Singletonu?

133

Koľko času trvala celá RAG pipeline od požiadavky po odpoveď?

125

Ako boli dokumenty načítané do vektorovej databázy? Ako prebiehal chunking?

116

Aký problém nastáva a ako ho vyriešiť, ak v asynchrónnej službe sa používa lokálny ML model (napríklad reranker), ktorý sa volá synchronne?

115

Ako boli získané embedde? Prostredníctvom akého modelu a ako bol spustený?

109

Ako funguje viacvláknové spracovanie v Pythone s ohľadom na GIL? Čím sa vlákna líšia od procesov?

106