İnferensiyanın hər mərhələsində LLM çıxışda nə alır?
Machine Learning / AI
ROC AUC nədir? ROC əyrisi necə qurulur?
LLM-as-a-Judge-in keyfiyyətin düzgün qiymətləndirildiyini necə yoxlamaq və onu necə kalibrləmək olar?
LLM tuning təcrübəsi də olubmu?
Logitlərin ölçüsü nədir və onlardan necə token alınır?
Bu sorğuda performans problemlərini müəyyən etmək üçün `EXPLAIN`-dən necə istifadə edərdiniz?
Hərbi biletin və ya qeydiyyat vərəqin varmı?
Sistemin yerli yerləşdirilməsi zamanı xüsusi məlumatlarla necə işləmək olar?
Hansı tapşırıqlarla üzləşirsən? Əsasən hansı texnologiya yığını istifadə edirsən?
Digər ML mühəndisləri əksinə, hər şeyi sınamaq üçün müxtəlif layihələr istəyirlər. Bəs siz, əksinə, nə istəyirsiniz...?
Zəhmət olmasa, maaş gözləntilərinizi bildirin.
Son vaxtlar yerinə yetirilmiş təsnifat tapşırığından danışın və onun pipeline'ını təsvir edin.
Obyektləri qiymətləndirmə ilə sıraladıqdan sonra ROC əyrisi necə hesablana bilər?
Alətləri necə təsvir edirdiniz? Ümumi format və təsvir üçün əsas tələblər nədir?
Ümumiyyətlə, tələbləri necə topladınız? Bu vəzifə hansı formada gəldi — fikir və ya ətraflı tapşırıq?
Graph RAG-ı necə həyata keçirdiniz? Niyə Qdrant istifadə etdiniz, əgər o yerli olaraq qrafikləri dəstəkləmir?
Retrieval-dən sonra istifadəçiyə cavab formalaşdırmaq üçün nə etmək lazımdır və RAG-da nəsil keyfiyyətini necə qiymətləndirmək olar?
Operatorun zəng zamanı riayət etməli olduğu yoxlama siyahısı var idi, yoxsa yoxlama onu olmadan həyata keçirildi?
Bu SQL sorğusunda operatorların icra sırasını göstərin
Top-K ilə keyfiyyəti ölçərkən və istifadəçidən soruşduğumuz metrik (bəyənirəm/bəyənmirəm) üçün eyni metrikləri istifadə edə bilərikmi? Yoxsa bunlar fərqli şeylərdir?