Gdzie można zobaczyć logi zadań w Airflow?
Data Engineer
Jak działa ClickHouse i czym różni się od PostgreSQL?
Jak Pandas obsługuje brakujące dane?
Wątki, multiprocessing, asyncio: jaka jest różnica i kiedy lepiej co używać?
Gdzie pojawia się równoległość w Airflow?
Jak parsować duże pliki XML w ZIP i ładować je do ClickHouse za pomocą Pythona?
Jak ORDER BY wpływa na tabelę ClickHouse i które klucze są lepsze do wyboru?
Jakie typy indeksów są w PostgreSQL?
Dlaczego Pandas jest lepszy od zwykłych list i słowników w Pythonie?
Czym różnią się generatory od list w Pythonie?
Jak zaktualizować tabelę w ClickHouse tak, aby użytkownicy nic nie zauważyli (zamiana atomowa)?
Czym jest GIL (Global Interpreter Lock)?
Jak nie zabić Jupyter lub Pandas przez pamięć?
Z czego zazwyczaj składają się logi zadań Airflow?
Do czego służą funkcje okienkowe?
Jak w Airflow utworzyć wiele identycznych zadań równolegle (np. załadować wiele identycznych plików)?
Jak działa JOIN w ClickHouse?
Jaka jest różnica między WHERE a HAVING?
Jak działa kompresja w ClickHouse?
Jakie silniki tabel w ClickHouse znasz i używałeś?