Data Engineer
Czym różni się WHERE od HAVING w SQL?
Co się stało i jak odzyskać pracę?
Czym różni się Greenplum od PostgreSQL?
print(len(' '.join(map(str, [0, 1]))))
Jaki jest idealny stosunek między zadaniami biznesowymi a zadaniami infrastrukturalnymi dla ciebie?
Jak naprawiłeś błąd danych według client_id, gdy jeden klient był znacznie większy od pozostałych? Jakie są opcje?
Co cię przyciąga do branży travel? Może sam lubisz podróżować, albo travel-tech jakoś cię zainteresował?
Jak dane z zewnętrznej tabeli były ładowane do tabel docelowych?
Czym jest witryna danych?
Załóżmy, że Data Vault nie jest dostępny i trzeba połączyć dwie szerokie tabele. Jak byś to zoptymalizował w Greenplum? A gdyby to było w ClickHouse?
Utworzono strukturę tabel wskazaną na obrazku. Należy wykonać zapytanie wskazane na obrazku. Jaki rodzaj join należy użyć zamiast [...], aby w wyniku dla rekordów z type = 'table_aw' została wypełniona kolumna 'naming', a dla rekordów z type = 'table2' — kolumna 'serial_number'? create table multirelation( type varchar not null, entity_id integer not null ); create table table_aw( id integer primary key, naming varchar not null ); create table table2( id integer primary key, serial_number varchar not null ); -- struktura tabel select m.type,m.entity_id, ta.naming, t2.serial_number from multirelation m [...] join table_aw ta on m.entity_id = ta.id and m.type='table_aw' [...] join table2 t2 on m.entity_id = t2.id and m.type='table2'; -- zapytanie Pozostawić puste inner cross right left
Jak połączyć dwie tabele w SQL?
Czy jesteś z Moskwy? Od dawna tu mieszkasz? Dlaczego przeprowadziłeś się do Moskwy?
Opowiedz o sobie, gdzie pracowałeś, czym się zajmowałeś, jakie były ciekawe zadania i porażki.
Nasz temat jest mocno strukturalny, drzewiasty, dane są surowe — jak je przetwarzać?
Jak zorganizować ładowanie danych do ClickHouse w dużej tabeli PostgreSQL, do której stale trafiają nowe rekordy z monotonnie rosnącym kluczem głównym?
Wymień znane Ci funkcje okienkowe SQL.
3 najważniejsze kryteria wyboru oferty, jeśli jest kilka propozycji.
Czy znasz bibliotekę w Rust, wielowątkową, bardzo szybką, która może zastąpić Pandas w Data Science i Big Data?
Czym jest Spark JDBC i jak efektywnie załadować dużą tabelę przez niego?