პანდასში, არის ცალი ტიპის int, მაგრამ ერთ ხაზზე მნიშვნელობა отсутствობს (NULL). რა ტიპის მონაცემი იქნება ამ ცალისთვის?
Python
ტიპების შემოწმებისთვის MyPy-ს იყენებდით?
რა უფრო სწრაფია: read_sql Pandas-ში თუ პირდაპირი კავშირი მონაცემთა ბაზასთან?
ვინ ცვლის კონტექსტს ასინქრონულ მიდგომაში?
რომელი ფრეიმვორკები გამოიყენეთ Python-ის კოდის დაწერისთვის?
სერვისის 5 ინстанციაა, რომელთაც აქვთ კრონ დავალება. როგორ დავრწმუნდეთ, რომ დავალება შესრულდება მხოლოდ ერთხელ, და არა 5-ჯერ?
შეგიძლიათ აღწეროთ განლაგების პაიპლაინის ნაბიჯები? კოდის კომიტიდან დაწყებული — რა ხდება შემდეგ?
რატომ არის საჭირო მონაცემთა ბაზის ნორმალიზაცია? როგორ განვსაზღვროთ, რამდენად უნდა იყოს ნორმალიზებული სქემა?
როგორ ვალიდიროთ FastAPI-ში შემომავალი CSV/Parquet ფაილი (აუცილებელი სვეტების არსებობა, მნიშვნელობების დიაპაზონი)?
რა განსხვავებაა Python-ის სიისა და NumPy-ის მასივის შორის?
სერვისებს შორის სინქრონული და ასინქრონული ურთიერთქმედების განსხვავება რა არის? როგორ ხორციელდება ისინი?
მოკლედ ისაუბრეთ საკუთარ შესახებ: ვინ ხართ, რა გამოცდილება გაქვთ, რატომ მოხვედით?
Pandas-ში 5 მილიონი მონაცემთა სიაა — რა უნდა გავაკეთოთ, თუ 100 ათასი ნორმალურად მუშაობდა, მაგრამ 5 მილიონი — არა?
შესაძლებელია თუ არა Airflow DAG-ში ციკლის შექმნა: დავალება 3 აბრუნებს შესრულებას დავალება 1-ზე არასაკმარისი მონაცემების შემთხვევაში?
რელაციური მონაცემთა ბაზებში (PostgreSQL) ინდექსები რა მიზნით გამოიყენება? როდის ეხმარება და როდის ზიანს აყენებს?
რატომ გახდა საჭირო განათლების კომპანია GetPositive-ისთვის საბანკო მონაცემთა საცავი დაწერა?
სისტემის დიზაინი: სამი გამოთვლის სერვისი, თითოეული მიმართავს მონაცემთა სერვისს, შედეგებს უნდა შეინახოს და სწრაფად გამოიტანოს ვებ-ინტერფეისში. როგორ ააშენოთ ასეთი სისტემა გამოთვლის გარანტიით?
ფუნქციონალური პროგრამირების და ობიექტზე ორიენტირებული პროგრამირების შორის რა განსხვავებაა? რა იყენებთ თქვენს მიდგომაში?
რომელი პაკეტების მენეჯერს იყენებთ?
როგორ გადავცეთ დიდი მონაცემების მოცულობა (მილიონობით სარჩევი) Airflow-ში?