Emberi modelin yaxşı işləyib-işləmədiyini necə müəyyən etmək olar? Hansı metriklər istifadə olunub?
Machine Learning / AI
Cross-encoder və bi-encoder arasındakı fərqi izah edə bilərsinizmi?
Əsas mətnlə müqayisədə yaradılan mətnin faktiki səhvlər içermədiyini yoxlamağın bir yolu varmı?
PDF sənədlərindən RAG sistemi üçün məlumatlar necə çıxarılıb?
modellərin kvantlaşdırılması haqqında danış: bu nədir, niyə lazımdır, hansı növləri var?
RAG sistemi üçün chunking strategiyası necə seçildi?
FastAPI-də həyata keçirilmiş xidməti necə sınaqdan keçirirsiniz?
ML xidməti performans göstəriciləri haqqında danış: gecikmə, RPS, bu necə təşkil olunub sənin layihəndə?
Vektor verilənlər bazaları haqqında danış, hansıları var, necə fərqlənirlər, niyə pgvector seçdiniz?
LLM-nin nəsil parametrləri haqqında danış: temperatur, top-k, top-p və digər.
Recall və Precision necə əlaqəlidir, birini azaltmadan digərini artıra bilərikmi? Tapşırıq nümunələri verin.
Bir layihədə ən çətin və ya çətinlik çəkən vəzifə haqqında danış.
Dialoqların xülasəsi üçün məlumatlar necə təşkil olundu və təlim necə keçirildi?
Hansı kvantlaşdırma metodu (int8 və ya float) modelin keyfiyyətinə daha az zərər verəcək?
Xülasənin keyfiyyətini necə qiymətləndirmək olar?
Bir konfransda çox insanın dialoqunu xülasə etmək vəzifəsinə necə yanaşardın (məsələn, Slack-də 10 inkişafçı)?
Konfransdan səsin işlənməsi üçün hansı model və yanaşma seçilməlidir (səsdən mətne, diarizasiya)?
LoRA haqqında danış: bu nədir, nə üçün lazımdır?
Sistemin yerli yerləşdirilməsi zamanı xüsusi məlumatlarla necə işləmək olar?
Niyə yalnız kosinus məsafəsi yerinə BM25 + embeddings hibrid axtarışını seçdiniz?