Data Engineer
Jak odzyskać pracę z zdalnej gałęzi, jeśli podczas próby `git checkout hotfix/missing-footer` pojawia się komunikat o błędzie, że gałąź nie została znaleziona?
W jaki sposób można przesłać dane z Greenplum i Trino do ClickHouse?
Jak dobrze znasz Pythona?
Iceberg to silnik, który pozwala zamienić S3 w bazę danych, nawet spełnia ACID. Jaka jest jego wada?
Co chciałbyś robić w naszym zespole?
W CTE zużywa się dużo pamięci – gdy mamy duże zużycie pamięci, co się dzieje z danymi?
Jak obejrzeć plan wykonania zapytania w Oracle? Czym różni się EXPLAIN PLAN od EXPLAIN ANALYZE?
Czym HDFS różni się od zwykłych rozproszonych systemów plików?
Czy indeksy zawsze przyspieszają wydajność, czy mogą powodować degradację?
Czym są martwe wiersze w bazie danych?
Czym różnią się generatory od list w Pythonie?
Opowiedz więcej o Spark: co dokładnie zostało zrealizowane, jakie metody zostały użyte
Jak nie zabić Jupyter lub Pandas przez pamięć?
Czym jest GIL (Global Interpreter Lock)?
Jaka jest różnica między WHERE a HAVING?
Potrzebujemy silnika pipeline — mechanizmu, który pozwoli na bardzo szybkie tworzenie przepływów poprzez podanie na wejście kontraktów i parametrów. Jak byś to zrealizował na wyższym poziomie?
Czy ACID jest przestrzegany w Greenplum?
Jakie zalety i wady ACID można wymienić, oprócz szybkości odczytu?
To jest w czasie rzeczywistym, jak to zrealizować między Kafka a ClickHouse Spark?
Jaki jest cel dzielenia danych na bloki w HDFS?