Előfordulhat versenyhelyzet Python aszinkron kódban?
Python
Hány dokumentumot szereztek meg a keresés során? Volt re-ranking?
Hogyan értékelték a RAG rendszer munkájának minőségét?
Hogyan működött a szemantikus cache a Redis-ben?
Hogyan monitorozta a szolgáltatás működését? Mit nézett a Grafanában?
Mit lehet még optimalizálni a predict módszerben? (minden alkalommal DataFrame létrehozása)
Miért jobb a POST használata a GET helyett ennél a végpontonál?
Írjon egy FastAPI webszolgáltatást, amely POST-kérést fogad adatokat (jövedelem, életkor, hitelösszeg) tartalmazva, és visszaadja a ML-modell jóslatát (hitel jóváhagyása)
Hogyan optimalizáljuk a szolgáltatást, hogy a szinkron CPU-feladat (előrejelző modell) ne blokkolja a FastAPI eseményhurokját?
Mesélj az egész RAG rendszer pipeline-ról: milyen dokumentumokat használtak, hogyan töltötték be és dolgozták fel őket?
Mi az a Singleton, és hogyan alkalmazzuk a modell betöltésére? Milyen hátrányai vannak a Singletonnak?
Mennyi időt vett igénybe az egész RAG pipeline a kérésétől a válaszig?
Hogyan töltötték fel a dokumentumokat a vektoralapú adatbázisba? Hogyan történt a chunking?
Milyen problémát okoz, és hogyan oldható meg, ha egy aszinkron szolgáltatásban helyi ML-modellt (pl. reranker) használunk, amely szinkron módon hívódik meg?
Hogyan készültek az embeddek? Milyen modellen keresztül és hogyan indultak el?
Hogyan működik a több szálas végrehajtás Pythonban a GIL figyelembevételével? Miben különböznek a szálak a folyamatoktól?