რა არის p-ფუნქცია და როგორ გამოიყენება იგი A/B ტესტის ანალიზში (ნული ჰიპოთეზის უარყოფა ან უარყოფა)?
Data Analyst
ორ სქელმოწერილი (RLE-კოდირებული) ვექტორების სკალარული გამრავლების ალგორითმის სიტყვებით ახსნა ერთ გადამოწმებით, მათი განბლოკვის გარეშე. რა არის დროის ასიმპტოტიკური სირთულე?
ავტომობილების კლასიფიკაციის დავალებაში ML-ის გამოყენება ნიშნების შერჩევისთვის იყო?
გააზიარეთ თქვენი ყველაზე საინტერესო პროექტები და რატომ გსურთ ანალიტიკაში განვითარება.
D. ჩინური ფეიერვერკები ვლადიმირი შეიძინა 3 ჩინური ფეიერვერკის ნაკრები. ისინი ზუსტად ერთნაირია და ყუთში ერთმანეთთან შერეულია, მაგრამ ინსტრუქციის მიხედვით, მათ სხვადასხვა სანდოობა აქვთ: 1. "ელიტური" — ხარვეზის დონე 10% (საგზნე შესაძლებლობა 0.9). 2. "სტანდარტული" — ხარვეზის დონე 20% (საგზნე შესაძლებლობა 0.8). 3. "ეკონომიკური" — ხარვეზის დონე 40% (საგზნე შესაძლებლობა 0.6). ვლადიმირი შემთხვევით აირჩევს პირველ ფეიერვერკს, აანთებს და ის წარმატებით მუშაობს. ბედნიერი, ვლადიმირი გადაწყვეტს დარჩენილი ორი ერთდროულად ააგოს. რა არის ალბათობა, რომ მეორე და მესამე ფეიერვერკიც წარმატებით იმუშაონ — ხარვეზის გარეშე? პასუხი გაანგარიშეთ სამი ათწილადამდე.
შესთავაზებული გადაწყვეტა SQLite-ისთვის მუშაობს?
Бир жолу, Yandex жарнамага каршы алдамчылык боюнча стажёр командага кошулду. Алдамчылык тобу иштеп жатканда, алар сайттарында боттор аркылуу трафикти имитациялап, ошентип, боттор тарабынан көрсөтүлгөн жарнамалар үчүн акча алышканда, стажёрдун милдети — мындай бардык алдамчылык сайттарды табуу болчу. Кызыгы, бул сайттардагы бардык трафик IP алмаштыруу менен түзүлгөн, бул бот A шаарынан келгендей көрүнүп турса да, чындыкта, түзмөк толугу менен башка жерде турган. Көп убакыт өттү, жана стажёр бул алдамчылык тобун камтуу аракетин жасады, айрым сайттарды жарым-жартылай кармап да алды. Бирок бүт тармакты кармай алган жок. Кийинчерээк, ал жаңылыкка көз жүгүрттү: A шаарында, 2025-жылдын 02.08, мобилдик интернет толугу менен жок болуптур. Бири-бири, кабелдик (үй) интернет иштеп жатты. Мунун баарын эске алып, стажёр бардык жалган сайттарды кантип таба алат? Сизде, 30.07.2025ден 10.08.2025ке чейин сайттардын логдары таблица форматында бар: timestamp | site_id | city_id Ар бир жазуу бир түзмөк аркылуу сайтка жасалган келүүнү көрсөтөт. Билесиз, боттордун трафиги күн сайын чындыкка караганда кыйла азыраак өзгөрөт. Сиздин милдетиңиз — аймагын A шаарына өзгөрткөн жана негизинен боттордон турган трафикти түзгөн бардык сайттарды табуу. Эскертүү Маалыматтарды камтыган таблица logs деп аталат. Мисал таблица жазуусу: timestamp | site_id | city_id [phone]:13:53 | 6e84d9b71ca44aea | A
შესთავაზებული გადაწყვეტილების ასიმპტოტიკური სირთულე დროისა და მეხსიერების მხრივ რა არის?
რატომ არის მაინცაც აზრი ბენჩმარკში პასუხის ფორმატის სტანდარტიზაციას, მიუხედავად იმისა, რომ ეს შეზღუდავს მოდელს?
თუ ნებადართულია ნებისმიერი ოპერაციის გამოყენება, შესაძლებელია თუ არა Array Except Self-ის პროდუქტის უფრო მარტივად გადაჭრა?
Product of Array Except Self პრობლემის გადაწყვეტის მეხსიერების სირთულე რა არის და რა დამატებითი ცვლადები გამოიყენება?
-- 1.2 როგორ შეიცვლება პასუხი, თუ შეცვლით JOIN-ის ტიპს LEFT-ზე? -- 1.3 მიუთითეთ ამ შეკითხვის ოპერატორების შესრულების წესრიგი. from join group by select order by limit -- 2. campaigns ცხრილი მოწესრიგდა: დუბლიკატები ამოიღეს, დაამატეს გასაღები (PK). -- ჩატარდა მეტი კამპანია, ბაგების გამო, მომხმარებლები დაიწყეს წარუმატებელი კომუნიკაციების მცდელობები, და ზოგიერთს საერთოდ ვერ აჩვენეს. -- მომხმარებლებს გამოგზავნილი პრომო-კამპანიების შესახებ: -- 2.1 დაწერეთ შეკითხვა, რომელიც აჩვენებს წარმატებით მიღებულ მომხმარებელთა რაოდენობას თითოეულ კამპანიაზე. -- 2.2 შეცვალეთ შეკითხვა, რათა აჩვენოს: მომხმარებელთა რაოდენობა, რომლებმაც საბოლოოდ ვერ მიიღეს არცერთი წარმატებული კომუნიკაცია, თითოეულ კამპანიაზე.
როგორ შევადაროთ მოდელის პასუხი გარე რეალობასთან (ground truth) ბენჩმარკში? რა მეტრიკას გამოვიყენოთ?
A. საუკეთესო სამეცნიერო ლაბორატორია დაწესებულ ქალაქში რამდენიმე სამეცნიერო ლაბორატორია ეწევა ბაქტერიალური კულტურების კვლევას. ისინი სწავლობენ ნიმუშების სერიას, სადაც თითოეული ნიმუში მიეკუთვნება კონკრეტულ შტამს (ბაქტერიის ტიპს). მთავარი ბიოლოგიური სამეცნიერო უნივერსიტეტი გამოაცხადა კონკურსი: უნდა იპოვოს მაქსიმალური რაოდენობა უწყვეტი ნიმუშების, რომლებიც შეიძლება გაანალიზდეს შეზღუდვის გათვალისწინებით. კერძოდ: ნებისმიერ უწყვეტ სეგმენტში უნდა იყოს არა მეტი, ვიდრე K სხვადასხვა შტამი. ჩვენი ლაბორატორია ცდილობს გახდეს საუკეთესო ქალაქში. გამარჯვებისთვის, ჩვენ უნდა ვიპოვოთ სწორედ ასეთი მაქსიმალური სიგრძის სეგმენტი, რომელიც აკმაყოფილებს მკაცრ პირობებს. ჩვენ გვსურს თქვენი დახმარება, რადგან გამარჯვების შემთხვევაში, ლაბორატორია მიიღებს გრანტს, რომელიც გახსნის ახალი ჰორიზონტებს ჩვენი კვლევებისთვის. შესავალი მონაცემები პირველი ხაზი შეიცავს ორ რიცხვს: N — ნიმუშების სერიის სიგრძე და K — შეზღუდვა სხვადასხვა შტამების რაოდენობაზე. მეორე ხაზი შეიცავს N რიცხვს — სერიის ელემენტები. გამოსავალი პროგრამამ უნდა გამოიტანოს ყველაზე გრძელი სეგმენტის სიგრძე ნიმუშების სერიის. მაგალითი 1 შესავალი [phone] გამოსავალი 3
ყველა მთელი რიცხვის სიისთვის, დააბრუნეთ იგივე ზომის სია, სადაც i-პოზიციაზე არის ყველა ელემენტის გამრავლება, გარდა იმ ელემენტის, რომელიც მდებარეობს ორიგინალურ სიაში i-პოზიციაზე მაგალითები: [2, 3, 4] -> [3*4, 2*4, 2*3] -> [12, 8, 6] def product_except_self(nums: list[int]) -> list[int]: # თქვენი კოდი აქ
შეგიძლიათ გვითხრათ, რომელი ტექნოლოგიური სტეკი და ინსტრუმენტები გამოიყენეთ და ვისწავლეთ?
წერეთ სრული ფუნქცია sum_series Python-ით და შეამოწმეთ მისი მაგალითზე დავალებაში.
რამდენად გსურთ მანქანათმცოდნეობის სწავლა და გსურთ მას თქვენს მუშაობაში ინსტრუმენტად გამოიყენოთ?
რა შეიცვლება, თუ COUNT(*)-ს დავაყენებთ COUNT()-ით არგუმენტების გარეშე?
როგორ შექმნიდი გეომეტრიის ბენჩმარკს? აღწერე ჯაჭვი იდეიდან საბოლოო მონაცემთა ნაკრებამდე.