Môže dôjsť k súťažnej podmienke v asynchrónnom kóde Python?
Python
Koľko dokumentov bolo získaných pri vyhľadávaní? Bol re-ranking?
Ako fungoval semantický cache v Redis?
Ako bola hodnotená kvalita práce systému RAG?
Ako ste sledovali fungovanie služby? Čo ste pozerali v Grafana?
Čo ešte možno optimalizovať v metóde predict? (vytváranie DataFrame pri každom volaní)
Prečo je lepšie použiť POST namiesto GET pre tento endpoint?
Napíšte webovú službu na FastAPI, ktorá prijíma POST požiadavku s údajmi (príjem, vek, výška úveru) a vracia predpoveď ML modelu (schválenie úveru)
Ako optimalizovať službu, aby synchronná CPU úloha (model predikcie) ne blokovala event loop FastAPI?
Povedaj mi celý pipeline RAG systému: aké dokumenty boli použité, ako boli načítané a spracované?
Čo je Singleton a ako ho použiť na načítanie modelu? Aké sú nevýhody Singletonu?
Koľko času trvala celá RAG pipeline od požiadavky po odpoveď?
Ako boli dokumenty načítané do vektorovej databázy? Ako prebiehal chunking?
Aký problém nastáva a ako ho vyriešiť, ak v asynchrónnej službe sa používa lokálny ML model (napríklad reranker), ktorý sa volá synchronne?
Ako boli získané embedde? Prostredníctvom akého modelu a ako bol spustený?
Ako funguje viacvláknové spracovanie v Pythone s ohľadom na GIL? Čím sa vlákna líšia od procesov?