Kui worker on sünkrone, kas tal on batching?
Machine Learning / AI
Kuidas kujundada salvestus- ja otsingusüsteem 10 000 Telegrami kanalile, millel on 300 000 postitust päevas ja latents on alla 2 sekundi?
Kas saab, kui embeddingsi otse API lõpp-punktis sünkronselt arvestada? Mida juhtub, kui arvutame embeddingsi suure dokumendivoogu jaoks FastAPI lõpp-punktis?
Kuidas kujundada süsteem automaatseks sisu loomiseks Telegrami kanalite jaoks kanali autori stiilis?
Kuidas te valideerisite LoRA täppisõpet?
Kas saaksite rääkida oma kogemusest RAG-süsteemidega ja sellest, mida te viimases projektis tegite?
Kas sa ise tegi seda kõike (RAG, LoRA, töö närvivõrkudega) või aitasid kellelgi?
Kas olete kunagi kasutanud närvivõrku kvaliteedi hindamise mõõdikuna?
Millal valida LoRA ja millal retrieval sarnaste postituste põhjal? Kui palju andmeid on vaja iga lähenemisviisi jaoks?
Millist järku saatsite LoRA jaoks ja millest see sõltub?
Millistes kihtides saatsite LoRA ja mis on q_proj?
Milliseid mõõdikuid kasutasite süsteemi kvaliteedi hindamiseks ja kuidas saavutasite 40% paranduse?
Kas sa oled paigaldanud närvivõrgud oma serveritesse või pilves?
Miks on selles arhitektuuris vajalik vektorpõhine andmebaas?
Miks LoRA võib üleõppida isegi väikese parameetrite arvuga? Kas rangi valik mõjutab üleõppimist?