Sobes.tech

Machine Learning / AI

DAG tapşırıqları üçün adətən hansı əsas parametrləri təyin edirik və niyə qrafik məhz belə olmalıdır (DAG-in yuxarı səviyyəli məntiqi)?

205

Spark ilə işlədinizmi? Bu nə olduğunu ümumi şəkildə necə başa düşürsünüz?

179

Sinif balansızlığı zamanı metriklərdən danışarkən — hansıları münasibdir və hansıları deyil?

173

Hərflər və rəqəmlər ehtiva edən bir sətir verilir. Sətirdə rast gəlinən ən böyük rəqəmi tapın (ardıcıl rəqəmləri tək bir rəqəm kimi nəzərə alın).

172

Python-da sətirlərin birləşdirilməsi zamanı nə baş verir (məsələn, current += char)? Niyə bu yanaşma bu tapşırıqda pis ola bilər və kodu necə optimallaşdırmaq olar, tez-tez sətir birləşdirmədən?

165

İşdə və ya məktəbdə təsadüfi meşə ilə rastlaşdınızmı? Təsadüfi meşə və boosting arasındakı əsas fərqlər nədir?

162

JOIN istifadə etmədən eyni klik axtarış problemini necə həll edərdiniz?

161

Airflow və ya Spark ilə işlədinizmi? Airflow-da DAG nədir, izah edə bilərsinizmi, təcrübənizdən nümunə verə bilərsinizmi? Siz DAG-ləri özünüz yazdınızmı yoxsa sadəcə istifadə etdiniz/işə saldınızmı?

158

Sinif balansızlığı zamanı dəqiqlik niyə qeyri-münasib keyfiyyət dəyərini göstərir?

155

Müddətli ardıcıllıqlarla işləmə təcrübəniz varmı? Müddətli ardıcıllıqların proqnozlaşdırma modellərinin keyfiyyətini qiymətləndirmək üçün hansı metriklər istifadə olunur?

151

100 sikkə var, onlardan biri saxtadır — hər iki tərəfdə iki qartal var. Təsadüfi olaraq bir sikkə seçirik, onu atırıq və qartal çıxır. Sikkənin saxta olma ehtimalı nədir? Həllini Bayes formulundan istifadə edərək izah edin.

150

İstifadəçilərin hadisələri (user_id, item_id, action_type, timestamp) ilə logs cədvəli verilir. Hər istifadəçi üçün ən son kliklədiyi məhsulun ID-sini tapmaq üçün SQL sorğusu yazın.

148

Əgər model üçün optimal ağac sayı 500-dürsə, amma təsadüfən həm təsadüfi meşə, həm də boosting 1000 ağac ilə öyrədilibsə, hansı model daha çox overfitt olacaq və niyə?

137

Spark-də vəzifə niyə ilişib qala və çox uzun çəkə bilər?

137