Sobes.tech

Python

Může dojít k race condition v asynchronním kódu Pythonu?

213

Kolik dokumentů bylo při hledání získáno? Došlo k re-rankingu?

189

Jak byla hodnocena kvalita práce systému RAG?

170

Jak jste sledovali chod služby? Co jste sledovali v Grafaně?

157

Co lze ještě optimalizovat v metodě predict? (vytváření DataFrame pokaždé)

146

Proč je lepší používat POST místo GET pro tento endpoint?

141

Napište webovou službu na FastAPI, která přijímá POST žádost s údaji (příjmy, věk, výše úvěru) a vrací předpověď ML modelu (schválení úvěru)

140

Jak optimalizovat službu, aby synchronní CPU úkol (předpovědní model) nezablokoval event loop FastAPI?

139

Pověz mi celý pipeline systému RAG: jaké dokumenty byly použity, jak byly načteny a zpracovány?

136

Co je Singleton a jak jej použít pro načítání modelu? Jaké jsou nevýhody Singletonu?

135

Jak dlouho trval celý RAG pipeline od požadavku po odpověď?

132

Jaký problém nastává a jak ho řešit, pokud v asynchronní službě používáte místní ML model (například reranker), který je volán synchronně?

120

Jak byly dokumenty načítány do vektorové databáze? Jak probíhal chunking?

118

Jak byly získány embedde? Přes jaký model a jak byl spuštěn?

111

Jak funguje vícenásobné vlákno v Pythonu s ohledem na GIL? Čím se vlákna liší od procesů?

106