Telegram kanallarının 10.000-i və gündəlik 300.000 post ilə saxlama və axtarış sistemi necə layihələndirilir, gecikmə 2 saniyədən azdır?
Machine Learning / AI
Əgər worker sinxron isə, batching olacaqmı?
API endpointində embeddings-ləri sinxron olaraq birbaşa hesablamaq mümkündürmü? FastAPI endpointində böyük sənəd axını üçün embeddings-ləri hesablasaq nə baş verər?
Telegram kanalları üçün kanal müəllifinin üslubunda avtomatik məzmun yaradılması üçün sistem necə layihələndirilir?
Keyfiyyətin qiymətləndirilməsi meyarı kimi neyron şəbəkəsindən istifadə etmisinizmi?
RAG sistemləri ilə işləmə təcrübəniz və son layihənizdə nə etdiyiniz haqqında danışa bilərsinizmi?
LoRA-nın incə tənzimləməsini necə təsdiqlədiniz?
LoRA-nı nə zaman seçmək və oxşar postlar üzrə retrieval nə zaman? Hər bir yanaşma üçün nə qədər məlumat lazımdır?
LoRA üçün hansı rütbə təyin etdiniz və ondan nə asılıdır?
Bunu özünüz etdinizmi (RAG, LoRA, neyron şəbəkələri ilə işləmək) yoxsa kimsəyə kömək etdinizmi?
Hansı qatlarda LoRA yerləşdirdin və q_proj nədir?
Öz serverlərinizdə və ya buludda neyron şəbəkələri qurmusunuzmu?
Sistem keyfiyyətini qiymətləndirmək üçün hansı metrikaları istifadə etdiniz və necə 40% yaxşılaşma əldə etdiniz?
LoRA niyə az parametr sayı ilə belə çox öyrənə bilər? Rəng seçimi çox öyrənməyə təsir edir mi?
Bu memarlıqda vektor məlumat bazası niyə lazımdır?