Vai jūs kādreiz esat strādājis ar AQE (Adaptive Query Execution) optimizatoru Spark? Vai zināt, kā tas darbojas?
Middle+
147
Vai jūs kādreiz esat strādājis ar AQE (Adaptive Query Execution) optimizatoru Spark? Vai zināt, kā tas darbojas?
Kāpēc meklējat jaunu darbu un ko vēlētos darīt nākotnē?
Kā fiziski notiek broadcast mehānisms — kā mazas tabulas daļas nonāk pie izpildītājiem ar lielu tabulu?
Kā Spark nosaka, ka tabula ir pietiekami 'maza' broadcast join (augšējā robeža)?
Kā tiek organizēti izlaišanas DBT? Vai izmantojat Airflow?
Un ja mums ir nepieciešami visi klienti, pat ja viņiem šajā datumā nebija darījumu, kā to parādīt?
Lūdzu, pastāstiet man par savu pieredzi pēdējā gada laikā: kāda komanda, kādi uzdevumi, kāda loma un kāds bija interesantākais uzdevums.
Ar saviem vārdiem, kas ir FULL JOIN?
Kādi JOIN veidi ir SQL (loģiski) un kā tie atšķiras?