Data Engineer
Miért éppen a DBT-t választottátok? Milyen előnyöket és hátrányokat látsz ebben a keretrendszerben?
Adott két tábla t1 és t2. A feladat az összes ismert join típus felsorolása és az eredmény megadása a select * from t1 <join> t2 on t1.t = t2.t kérésre minden esetben. |t1.t| ------ 1 2 4 null ------ |t2.t| ------ 1 3 null null cross 1 1 - null null - INNER JOIN [phone] LEFT JOIN 1 - 1 2 - NULL 4 - NULL NULL - NULL RIGHT JOIN [phone] NULL - 3 NULL - NULL NULL - NULL FULL JOIN [phone] - NULL 4 - NULL NULL - 3 null - NULL null - NULL null - NULL
Mi az a YARN és mire való?
Mi az az SQL-injektálás?
Hogyan fordulhat elő SQL-injektálás a dátumbeviteli mezőn keresztül?
Hogyan működtek az analitikus függvények (ablakfüggvények)?
Milyen fizikai kapcsolatok (összekapcsolási módszerek) léteznek?
Mire jók az indexek, mik az előnyeik és hátrányaik?
Milyen korlátozások vannak a hash tábla használatában?
Mit tesz, amikor problémába ütközik a gyártási folyamatban?
Mi történik, amikor egy egydarabos Postgres-ban párhuzamosítjuk a lekérdezéseket?
A nyomkövetés csak REST-kéréseket mutat vagy valami mást is?
Mik a hátrányai az MPP architektúrának a Greenplum-ben?
Mesélj magadról — munkatapasztalat, technológiai stack
Hogyan állíthatod helyre a munkát egy távoli ágról, ha a `git checkout hotfix/missing-footer` parancs futtatásakor hibát kapsz, hogy az ág nem található?
Hogyan működik a partícionálás a Hive-ben, és hogyan van fizikailag ábrázolva a fájlrendszerben?
Milyen típusú táblákat használtál a Greenplum-ban? Milyen esetekben használtad a heap-et, és milyen esetekben az Append-Optimized-et?
Hogyan lehet adatokat átvinni a Greenplum és Trino-ból a ClickHouse-ba?
Milyen módszerek léteznek az adatok törlésére a ClickHouse-ban?
Miben különbözik az HDFS a szokásos elosztott fájlrendszerektől?