Data Engineer
Czy pracowałeś z feature store'ami?
Czy masz doświadczenie w konfigurowaniu pipeline w CI/CD, na przykład GitLab?
Czym różni się WHERE od HAVING w SQL?
Jak opisałbyś w kodzie sprawdzenie, czy wartość znacznie różni się od normalnego (oczekiwanego) rozkładu?
Co się stało i jak odzyskać pracę?
Przy streamingu Iceberg działał, słyszałeś? To jest śmietnikowe przechowywanie plików.
Jaki format pracy jest dla Ciebie wygodniejszy — biuro, hybrydowy czy zdalny? Mamy dwa biura, na Kutuzowskim i na Tuli.
Czym różni się Greenplum od PostgreSQL?
Czym jest CROSS JOIN i jaki jest wynik jego zastosowania?
Jak naprawiłeś błąd danych według client_id, gdy jeden klient był znacznie większy od pozostałych? Jakie są opcje?
Co cię przyciąga do branży travel? Może sam lubisz podróżować, albo travel-tech jakoś cię zainteresował?
W jakiej kolejności wykonywane są główne operacje w SQL: SELECT, FROM itp.?
Jak przekazywać dane między zadaniami w Airflow?
Jak dane z zewnętrznej tabeli były ładowane do tabel docelowych?
Co jest wyzwalaczem tworzenia nowego Joba w Spark i jak Job dzieli się na Stages i Tasks?
Opowiedz o sobie: czym się zajmowałeś, jakiego stosu technologicznego używałeś i jaki to był projekt?
Czym jest witryna danych?
Czy masz pytania dotyczące zespołu i roli?
Na jakich technologiach oparty jest twój lakehouse i jakie problemy pojawiają się podczas pracy z Apache Iceberg?
Proszę opowiedz o swoim doświadczeniu w ostatnim roku: jaki zespół, jakie zadania, jaka rola i jakie było najciekawsze zadanie.