Machine Learning / AI
RAG სისტემის პაიპლაინი (ფილტრი, რერანკინგი) როგორ იყო მოწყობილი, რა გააკეთეთ პირადად და რა კოლეგებმა?
Re-ordinator როგორ მუშაობს, დეტალებში შევიდა თუ გამოიყენე როგორც მზად საინჟინრო ბლოკი?
რა განსხვავებაა GPT არქიტექტურასა და BERT არქიტექტურას შორის?
-- 1.1 რა აჩვენებს სვეტა: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign AS campaign -- 1.2 როგორ შეიცვლება პასუხი, თუ შეცვლით JOIN-ის ტიპს LEFT-ზე? -- 1.3 მიუთითეთ ამ სვეტაში ოპერაციების შესრულების წესრიგი. -- 2. campaigns ცხრილი მოწესრიგდა: დუბლიკატები ამოიღეს, დაემატა გასაღები (PK). -- ჩატარდა მეტი კამპანია, შეცდომების გამო მომხმარებლები დაიწყეს წარუმატებელი კომუნიკაციების მცდელობები, და ზოგიერთი საერთოდ არ გამოჩნდა. -- მაგალითი 1: communications -- | user_id | campaign | status | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | error | -- მაგალითი 2: communications -- | user_id | campaign | status | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- მომხმარებლებს გადაგზავნილი პრომო-კამპანიების შესახებ: -- 2.1 დაწერეთ სვეტა, რომელიც აჩვენებს, რამდენი მომხმარებელი მიიღო წარმატებით კომუნიკაცია, თითო კამპანიისთვის. -- 2.2 შეცვალეთ სვეტა, რათა აჩვენოს: რამდენი მომხმარებელი არ მიიღო არცერთი წარმატებული კომუნიკაცია, თითო კამპანიისთვის.
როდის იქნებით მზად პროექტის დაწყებისთვის?
გააზიარეთ პროდუქტის სრული ციკლი ახალი ბაზრისთვის [კომპანია]: რას გულისხმობთ სრული ციკლში, რა ეტაპები, მეტრიკები, შედეგები.
რა კიდევ შეიძლება გამოყენებულ იქნას დანაკარგის ფუნქციად კროს-ენტროპიის გარდა?
გვითხარით საკუთარ შესახებ და თქვენს შესაბამის გამოცდილებაზე.
გააზიარე ტრანსფორმატორის ძირითადი არქიტექტურა, რა არის მისი ძირითადი ნაწილები.
როგორ იცვლიან პოზიციური ჩაშენებები Q, K, V?
არსებობს თუ არა კონკრეტული განვითარების მეთოდოლოგია (Agile, Scrum, Kanban)?
რატომ CatBoost, არა XGBoost ან LightGBM? რა განსხვავებებია?
ახალი სამუშაო ადგილის არჩევისას რა არის თქვენთვის მნიშვნელოვანი? დავალებები თუ პროდუქტის გუნდში მუშაობა?
გააზიარე გენერაციის პარამეტრებზე: ტემპერატურა, Top-P და Top-K.
რა არის კლასი ბალანსის ნაკლებობა NER-ში და როგორ მუშაობა ამასთან?
გეცოდინებათ თუ არა რა არის bagging? მიანიშნეთ ალგორითმის მაგალითი.
გთხოვთ, მოგვიყევით თქვენი გამოცდილების შესახებ Data Scientist თანამდებობის კონტექსტში.
როგორ გაზომეთ მონაცემების ამოღების ხარისხი?
რა არის RAG და რა არის მისი ძირითადი კომპონენტები?
რა მეტრიკები გამოიყენეს RAG სისტემის შეფასებისთვის და როგორ მიიღეს გადაწყვეტილება მას წარმოებაში განთავსების შესახებ?