Hai usato XCom in Airflow?
Data Engineer
Quando si può usare la famiglia di formati CSV?
Puoi spiegare il partizionamento in Oracle: a cosa serve e quali tipi ci sono?
È possibile visualizzare lo schema della tabella prima di eseguire la query in Hive?
Cosa sono le viste (VIEW) e le viste materializzate (MATERIALIZED VIEW) in Oracle? Come vengono aggiornati i dati in una vista materializzata?
Quali altri formati di file, oltre a Parquet, funzionano bene con Hadoop e Hive?
Parlami del tuo progetto precedente, quali erano le tue responsabilità?
Cosa sono le operazioni lazy in Spark e a cosa servono?
Il piano di esecuzione di EXPLAIN corrisponde sempre a ciò che viene effettivamente eseguito?
Come si adatta la tua esperienza alle responsabilità della posizione: accompagnamento e analisi dei processi di caricamento, monitoraggio e individuazione di anomalie, testing e installazione di miglioramenti in produzione, supporto di secondo livello, verifica della documentazione tecnica?
Hai dovuto lavorare con Oracle Data Integrator (ODI)?
Come conoscere il piano reale di esecuzione di una query in Oracle?
Quali sono i vantaggi e gli svantaggi dei sistemi di database distribuiti?
Puoi ricordare la tua esperienza nell'ottimizzazione delle query? Come hai agito, analizzato?
C'è stata una query analitica lenta in Hive. Come capire cosa è successo e come ripararla?
Perché si separano le viste (VIEW) e le tabelle? A cosa servono le viste?
Qual è stata la tua architettura nel progetto? DWH o qualcos'altro?
Qual è la differenza tra multithreading e multiprocessing? Per quali compiti usare i thread e per quali processi?
Hai lavorato con caricamenti batch o streaming?
Hai lavorato con funzioni di finestra? Quali tipi di funzioni di finestra conosci?