Kiedy można używać rodziny formatów CSV?
Data Engineer
Opowiedz o partycjonowaniu w Oracle: do czego służy i jakie są jego rodzaje?
Czy używałeś XCom w Airflow?
Czy można zobaczyć schemat tabeli przed wykonaniem zapytania w Hive?
Czym są widoki (VIEW) i widoki materializowane (MATERIALIZED VIEW) w Oracle? Jak aktualizowane są dane w widoku materializowanym?
Jak Twoje doświadczenie odpowiada obowiązkom na stanowisku: wsparcie i analiza procesów ładowania, monitorowanie i wykrywanie anomalii, testowanie i wdrażanie poprawek w produkcji, wsparcie drugiej linii, sprawdzanie dokumentacji technicznej?
Czy plan wykonania z EXPLAIN zawsze odpowiada temu, co jest faktycznie wykonywane?
Jakie inne formaty plików, oprócz Parquet, dobrze współpracują z Hadoop i Hive?
Czym są operacje leniwe w Spark i do czego służą?
Jak poznać rzeczywisty plan wykonania zapytania w Oracle?
Czy musiałeś pracować z Oracle Data Integrator (ODI)?
Opowiedz mi o swoim poprzednim projekcie, jakie miałeś obowiązki?
Czym różni się wielowątkowość od wieloprocesowości? Do jakich zadań używać wątków, a do jakich procesów?
Jakie są zalety i wady rozproszonych systemów baz danych?
Czy możesz przypomnieć sobie swoje doświadczenie w optymalizacji zapytań? Jak działałeś, analizowałeś?
Czy pracowałeś z funkcjami okienkowymi? Jakie rodzaje funkcji okienkowych znasz?
Czy masz doświadczenie z FastAPI?
Jaka była Twoja architektura w projekcie? DWH czy coś innego?
W Hive wystąpiło wolne zapytanie analityczne. Jak zrozumieć, co się z nim stało i jak je naprawić?
Czy pracowałeś z ładowaniem wsadowym lub streamingiem?