Data Engineer
Analisi del modello dbt con strategia incrementale: cosa fa il modello, ci sono problemi?
Quale risorsa viene consumata di più in un Nested Loop Join?
Qual è la differenza tra == e is in Python?
Hai offerte o proposte concorrenti da altre aziende?
Quali sono i tipi di JOIN in SQL (logici e fisici)?
Quale espressione al posto di [...] porterà automaticamente alla creazione di un indice? Sulla piattaforma mobile c'è uno scorrimento orizzontale del codice create table some_table( col_name [...] ); unique references other_table(col_name) not null serial integer check (col_name > 0)
Quali gruppi di operatori SQL conosci? A cosa appartengono?
Quali sono i vantaggi del pattern Strategia nel refactoring di questo codice?
Hai lavorato con Git? Cosa conservavi in Git?
Come influenzano i file di swap le prestazioni? Quando possono verificarsi altri file di swap?
Hai esperienza con le immagini Docker, configurando ambienti su una macchina virtuale?
Come aggiornare una tabella in ClickHouse in modo che gli utenti non notino nulla (sostituzione atomica)?
Come determina Spark che una tabella è abbastanza 'piccola' per un broadcast join (limite superiore)?
Cosa non ti piace attualmente del tuo lavoro?
Raccontaci la tua esperienza con Airflow (l'orchestratore). Cosa hai usato?
Cosa è importante per te in un nuovo progetto, in un nuovo team o in una nuova azienda?
Quali query SQL scrivi: controlli semplici o script complessi per i data warehouse?
Cos'è una CTE (Espressione di Tabella Comune)?
Hai caricato dati da Spark su S3 in formato Parquet, e poi da Parquet a Greenplum — come avviene il processo di caricamento?
Quanto sono realistici i piani dell'azienda per costruire un sistema di raccolta, normalizzazione e analisi dei dati?