Data Engineer
Naša tema je veoma strukturirana, u obliku stabla, podaci su sirovi — kako ih obraditi?
Na koju platu računaš?
Ispričajte nam o korišćenju PL/SQL procedura u vašem radu.
Da li ste ikada radili sa AQE (Adaptive Query Execution) optimizatorom u Spark-u? Znate li kako on funkcioniše?
Da li je rečnik u Pythonu promenljivog ili nepromenljivog tipa? Koji su zahtevi za njegove ključeve i vrednosti?
Sa kojom verzijom Airflow ste radili?
Šta ti je važno u novom projektu, novom timu ili kompaniji?
Колико је укупно било преузимања — високо ниво послови, нитови?
Da li imate pitanja o timu i ulozi?
[ime] je pitao: Kako implementirati čuvanje podataka samo na 2 godine u ClickHouse?
Zašto se koriste dekoratori u Apache Airflow?
Koji su tvoji planovi za narednih 5 godina? U kojim oblastima želiš da se razvijaš?
Šta je RDD u Apache Spark i po čemu se razlikuje od drugih apstrakcija Spark?
Kako spojiti dve tabele u SQL?
Za koje zadatke ClickHouse nije pogodan i šta biste izabrali umesto njega?
git submodule update --init
Da li plan izvršenja iz EXPLAIN uvek odgovara onome što se zaista izvršava?
Kako osigurati mobilnom klijentu pristup do istih narudžbina, ali sa manjim skupom polja? Šta je BFF?
Imate upit koji loše radi, je spor ili se ruši — kako ga optimizovati?
Имате ли искуства у оптимизацији Spark задатака? Можете ли дати конкретан пример?