Data Engineer
Quali tipi di tabelle hai usato in Greenplum? In quali casi si usava heap e in quali Append-Optimized?
Cosa ti piacerebbe fare nel nostro team?
Come si possono trasferire i dati da Greenplum e Trino a ClickHouse?
Iceberg è un motore che permette di trasformare S3 in un database, rispettando anche le proprietà ACID. Qual è il suo svantaggio?
In cosa si differenzia HDFS dai normali sistemi di file distribuiti?
Cosa sono le righe morte nel database?
Parlami più nel dettaglio di Spark: cosa è stato implementato esattamente, quali metodi sono stati usati
Gli indici migliorano sempre le prestazioni o possono causare degrado?
Abbiamo bisogno di un motore di pipeline — un meccanismo che consenta di creare flussi molto rapidamente fornendo contratti e parametri in ingresso. Come lo implementeresti a un livello superiore?
Viene rispettato l'ACID in Greenplum?
Quali sono i vantaggi e gli svantaggi dell'ACID, oltre alla velocità di lettura?
Qual è la differenza tra generatori e liste in Python?
È in tempo reale, come implementarlo tra Kafka e ClickHouse Spark?
Come non uccidere Jupyter o Pandas per memoria?
Cos'è GIL (Global Interpreter Lock)?
Come visualizzare il piano di esecuzione di una query in Oracle? In cosa si differenziano EXPLAIN PLAN e EXPLAIN ANALYZE?
Qual è lo scopo di suddividere i dati in blocchi in HDFS?
Nel CTE si utilizza molta memoria: quando abbiamo un alto consumo di memoria, cosa succede ai dati?
Quanto conosci Python?
Qual è la differenza tra WHERE e HAVING?