Ar gali įvykti lenktynių sąlyga Python asinchroniniame kode?
Python
Kiek dokumentų buvo surinkta paieškos metu? Ar buvo re-ranking?
Kaip įvertinta RAG sistemos darbo kokybė?
Kaip veikė semantinė talpykla Redis?
Kaip stebėjote paslaugos darbą? Ką žiūrėjote Grafanoje?
Ką dar galima optimizuoti predict metode? (kiekvieną kartą DataFrame kūrimas)
Kodėl geriau naudoti POST vietoj GET šiai galinei taškui?
Parašykite „FastAPI“ žiniatinklio paslaugą, kuri priima POST užklausą su duomenimis (uždarbis, amžius, kredito suma) ir grąžina ML modelio prognozę (kredito patvirtinimas)
Kaip optimizuoti paslaugą, kad sinchroninė CPU užduotis (prognozės modelis) nepakeistų FastAPI event loop'o?
Papaskink man apie visą RAG sistemos pipeline'ą: kokie dokumentai buvo naudojami, kaip jie buvo įkelti ir apdoroti?
Kas yra Singleton ir kaip jį taikyti modelio įkėlimui? Kokie yra Singleton trūkumai?
Kiek laiko užtruko visas RAG pipeline nuo užklausos iki atsakymo?
Koks yra problema ir kaip ją išspręsti, jei asinchroniniame serveryje naudojamas vietinis ML modelis (pvz., reranker), kuris yra kviečiamas sinchroniškai?
Kaip dokumentai buvo įkeliami į vektorinę duomenų bazę? Kaip vyko chunking?
Kaip buvo gauti embeddingai? Per kokį modelį ir kaip jis buvo paleistas?
Kaip veikia daugiagyslė Python su GIL? Kuo skiriasi srautai nuo procesų?