Jiddiy sinf muvozanatsizligi holatida, aniqlik, recall va PR-AUC qanday harakat qiladi?
Machine Learning / AI
Қандай метрикалардан foydalanгансиз, qancha ma'lumot bor edi va sinflar qanday balansda edi?
O'zingiz va bajargan vazifalaringiz haqida gapiring.
Agar siz faqat cheklangan sonli mijozlar bilan aloqa qilishingiz mumkin bo'lsa, bunday scoring modelini qanday baholaysiz?
Бу тасвирлаш ёки вақт қатори вазифаси эди? Тренинг ва текширишда вақтни қандай ҳисобга олдин?
ROC-AUC haqida nima bilasiz?
Obyektlarni baholash bo'yicha reytingdan so'ng ROC egri qanday hisoblanadi?
Yaqinda bajarilgan tasniflash vazifalaridan birini va uning pipeline'ini ta'riflang.
PR-AUC nima ko'rsatadi?
Skoring modeli nima ekanligini bilasizmi?
Bajarilgan NLP vazifangiz haqida gapiring.
Operatorning qo'ng'iroq davomida amal qilish uchun ro'yxati bor edimi yoki tekshirish uni olmadan amalga oshirildi?
Yanvar oyida, 30 kun ichida aloqa qilgandan keyin kamida bir marta sotuv qilgan barcha mijozlarni toping.
Klasterni vazifa haqida gapiring.
Maqsad va tasdiqlangan xususiyatlar do'koni bilan taxminan 5000 xususiyatlar mavjud. Buni qanday tekshirasiz bu vazifada?
Yanvar oyida, 30 kun ichida aloqa qilgandan keyin kamida bir marta sotuv qilgan barcha mijozlarni toping. sotuvlar id mijoz_id miqdor sotuv_sanasi [phone] aloqalar id mijoz_id tur aloqa_sanasi bo'linma_sanasi 1 1 pochta [phone] chaqiriq [phone] chaqiriq [phone] elektron pochta [phone] sms [phone] #Ro'yxat mavjud, siz ikkita ro'yxatni qaytaradigan funktsiya yozishingiz kerak, biri normal qiymatlar bilan, ikkinchisi anomaliyalar bilan. Hozircha, anomaliya ortacha qiymatdan oshadigan qiymat deb faraz qilamiz data = [100, 200, 150, 5000, 1300, 120, 700, 2000, 200]
Nadir konversiya vazifasida, millionlab tanlangan mijozlar uchun 700 sotuvning aniqligi yaxshi mi?
Necha xususiyatni feature store'dan olasiz va ularni qanday tanlaysiz, agar barcha 5000 xususiyat to'g'ri va hech qanday oqishsiz bo'lsa?