Mit tudsz mondani a SOAP API-ról?
Data Engineer
Hogyan indították el a DAG-okat: cron, adatkészletek, trigger-ek vagy függőségek szerint?
Milyen adatminőség-ellenőrzéseket végeztek a Data Vault-ban?
Hogyan csatlakoztak az OpenMetadata-hoz, és mit csináltak vele?
Adj példát egy tipikus DAG írási feladatra az Airflow-ban.
Hogyan követhető nyomon, hogy melyik DAG futásában jelent meg egy adott sor a Data Vault-ban?
Adminisztráltad az Airflow-t vagy csak fejlesztőként dolgoztál?
Hogyan optimalizálták a táblákat és lekérdezéseket: partíciók, indexek, kiválasztási logika?
Használható-e a véletlenszerű eloszlás a Greenplum-ban, és mikor érdemes?
Mesélj magadról: mivel foglalkoztál, milyen technológiákat használtál és milyen projekt volt ez?
Milyen SQL lekérdezéseket írsz: egyszerű ellenőrzéseket vagy összetett szkripteket adattárakhoz?
Történt-e további naplózás az Airflow naplók mellett?
Használtál Bridge-t és PIT-táblákat a Data Vault-ban? Adj példát és magyarázd meg a céljukat.
Mikor adhatsz visszacsatolást, és vannak-e ajánlataid?
Milyen további Data Vault entitások kerültek használatra, például same-as links vagy transactional links, a hub, link és satellite mellett?
Sorolja fel az általad ismert SQL ablakfüggvényeket.
Az S3 volt az egyetlen fő tároló vagy több is volt?
Egy S3 vödröt használtak vagy többet? Milyen elv szerint?
Milyen tárolási típusú a Parquet: soros vagy oszlopos?
Felépítették az eredettől a fogyasztóig tartó láncot?