P-dəyəri nədir və A/B testinin hesablanması zamanı (sıfır hipotezini rədd etmək və ya rədd etməmək) necə nəticələr çıxarılır?
Data Analyst
İki sıxılmış (RLE kodlu) vektorların skalar hasilini tək keçiddə, onları açmadan hesablama alqoritmini sözlə izah edin. Zaman baxımından asymptotik mürəkkəblik nədir?
Avtomobillərin təsnifat tapşırığında xüsusiyyətlərin seçilməsi üçün ML istifadə olunubmu?
Ən maraqlı layihələriniz haqqında danışın və niyə analizdə inkişaf etmək istəyirsiniz.
Təklif olunan həll SQLite üçün işləyərmi?
Bir zamanlar, Yandex Reklamları saxtakarlıq üzrə stajyer komandaya qoşuldu. Saxtakarlıq qrupu aktiv idi və botlar vasitəsilə saytlarında trafiki simulyasiya edirdi və beləliklə, botlar tərəfindən reklam göstərişi üçün pul alırdı, stajyerin vəzifəsi bütün bu saxtakarlıq saytlarını tapmaq idi. Maraqlıdır ki, bu saytlar üzərindəki bütün trafik IP dəyişdirilməsi ilə yaradılmışdı və sanki bot A şəhərindən ziyarət edirmiş kimi görünürdü, amma əslində cihaz tamamilə başqa yerdə idi. Çox vaxt keçdi və stajyer bu saxtakarlıq qrupunu əhatə etməyə çalışdı, hətta bəzi saytları qismən tutmağa müvəffəq oldu. Amma bütün şəbəkəni tutmaq mümkün olmadı. Bir müddət sonra, o xəbər gördü: A şəhərində, 02.08.2025 tarixində, mobil internet tamamilə yox idi. Ancaq, kabel (ev) interneti işləməyə davam edirdi. Buna görə, stajyer bütün saxtakarlıq saytlarını necə tapa bilər? Sizdə, 30.07.2025-dən 10.08.2025-ə qədər olan dövr üçün saytların logları cədvəl formatında mövcuddur: timestamp | site_id | city_id Hər qeyd, bir cihaz tərəfindən bir saytın ziyarətini göstərir. Bilirsiniz ki, bot trafiki, hər gün real trafiyə nisbətən çox az dəyişir. Sizin vəzifəniz, regionunu şəhər A olaraq dəyişən və əsasən botlardan ibarət trafiki olan bütün saytları tapmaqdır. Qeyd Məlumatların saxlandığı cədvəl logs adlanır. Cədvəldə nümunə qeyd: timestamp | site_id | city_id [phone]:13:53 | 6e84d9b71ca44aea | A
D. Çin atəşfəşanlığı Vladimir 3 Çin atəşfəşanlığı dəstini satın aldı. Onlar tamamilə eynidir və qutuda qarışıqdırlar, amma təlimatlara görə, onların müxtəlif etibarlılığı var: 1. "Elit" — defekt faizi 10% (uğur ehtimalı 0.9). 2. "Standart" — defekt faizi 20% (uğur ehtimalı 0.8). 3. "İqtisadi" — defekt faizi 40% (uğur ehtimalı 0.6). Vladimir təsadüfi olaraq ilk atəşfəşanlığı seçir, yandırır və o uğurla işləyir. Xoşbəxtlikdən, Vladimir qalan iki atəşfəşanlığı ardıcıl olaraq atmağa qərar verir. İkinci və üçüncü atəşfəşanlığın da uğurla işləmək ehtimalı — defektsiz? Cavabı üç ondalık yerə yuvarlaqlaşdırın.
Təklif olunan həllin zaman və yaddaş baxımından asymptotik mürəkkəbliyi nədir?
Hər hansı bir əməliyyatdan istifadə etməyə icazə verilərsə, Array Except Self məhsulunu daha sadə şəkildə həll etmək mümkündürmü?
Niyə benchmarkda cavab formatının standartlaşdırılması hələ də məntiqlidir, hətta modelə məhdudiyyət qoysa belə?
-- 1.2 Cavab necə dəyişəcək, əgər JOIN növünü LEFT-ə dəyişsək? -- 1.3 Bu sorğudakı əməliyyatların icra ardıcıllığını göstərin. from join group by select order by limit -- 2. campaigns cədvəli düzəldildi: təkrarlamalar aradan qaldırıldı, açar (PK) əlavə olundu. -- Daha çox kampaniya keçirildi, səhvlər səbəbindən istifadəçilər uğursuz çatdırılma cəhdləri ilə qarşılaşdılar və bəziləri ümumiyyətlə göstərilə bilmədi. -- İstifadəçilərə göndərilən promosyon kampaniyaları haqqında: -- 2.1 Hər kampaniya üçün müvəffəqiyyətlə alınan istifadəçi sayını göstərən sorğu yazın. -- 2.2 Sorğunu dəyişdirin ki, göstərilsin: ümumilikdə heç bir müvəffəqiyyətli kommunikasiya almayan istifadəçi sayı, hər kampaniya üçün.
A. Ən Yaxşı Elmi Laboratoriya Müəyyən bir şəhərdə, bir neçə elmi laboratoriya bakterial mədəniyyətləri araşdırır. Onlar nümunələrin ardıcıllığını öyrənirlər, hər nümunə müəyyən bir suş (bakteriya növü) aid olur. Əsas bioloji tədqiqat universiteti müsabiqə elan etdi: məhdudiyyəti nəzərə alaraq, analiz edilə biləcək ən çox ardıcıl nümunələrin sayını tapmaq. Yəni: hər hansı davamlı seqmentdə, ən çox K müxtəlif suş olmalıdır. Bizim laboratoriyamız şəhərdə ən yaxşı olmaq istəyir. Müsabiqəni qazanmaq üçün, biz dəqiq bu cür maksimum uzunluqlu seqment tapmalıyıq ki, bu da sərt şərti ödəyir. Sizdən asılıyıq, çünki qələbə halında, laboratoriya yeni tədqiqat imkanlarını açacaq maliyyə dəstəyini alacaq. Giriş formatı İlk sətirdə iki ədəd verilir: N — nümunə ardıcıllığının uzunluğu və K — müxtəlif suşların sayı üçün məhdudiyyət. İkinci sətirdə N ədəd — seqmentin elementləri. Çıxış formatı Proqram, nümunə ardıcıllığının ən uzun seqmentinin uzunluğunu çıxarmalıdır. Nümunə 1 Giriş [phone] Çıxış 3
Product of Array Except Self probleminin həllinin yaddaş mürəkkəbliyi nədir və hansı əlavə dəyişənlər istifadə olunur?
Modelin cavabını benchmarkda əsas (ground truth) ilə necə müqayisə etmək olar? Hangi metrikadan istifadə etmək lazımdır?
Tam ədədli siyahı üçün, eyni ölçülü siyahı qaytarın, burada i-ci mövqedə, orijinal siyahının i-ci mövqeyindən başqa, tüm elementlərin hasilidir Nümunələr: [2, 3, 4] -> [3*4, 2*4, 2*3] -> [12, 8, 6] def product_except_self(nums: list[int]) -> list[int]: # kodunuzu buraya yazın
Hansı texnologiya yığını və alətləri istifadə etdiyinizi və mənimsədiyinizi izah edə bilərsinizmi?
Python-da tam funksiyalı sum_series funksiyasını yazın və tapşırıq nümunəsi ilə yoxlayın.
COUNT(*) yerinə arqumentsiz COUNT() ilə dəyişsəniz, nə dəyişəcək?
Maşın öyrənməyə nə dərəcədə maraqlısınız və onu işinizdə alət kimi tətbiq etmək istəyirsinizmi?
Coşqun üçün bir benchmark necə yaradardın? Fikirdən son məlumat dəstinə qədər zənciri təsvir et.