Ինչպես է աշխատում Oracle-ի հարցման օպտիմիզատորը, ինչ է դիտում և որ դասին է պատկանում?
Data Engineer
Ի՞նչ է HDFS-ում տվյալների բլոկների բաժանման իմաստը։
Ինչպես աշխատեցիք Impala-ով?
Ինչով է HDFS-ը տարբերվում սովորական տարածված ֆայլային համակարգերից:
Ինչպես է աշխատում MapReduce-ը, մասնավորապես Reduce փուլը?
Ի՞նչ է YARN-ը և ինչու է այն անհրաժեշտ:
Ինչպես աշխատեցիք CI/CD-ով?
Ինչպե՞ս եք բեռնել տվյալները S3-ից Greenplum-ին:
Ի՞նչ է shuffle-ը Spark-ում և ինչու է կարևոր նվազեցնել այն։
Ինչպե՞ս դիտել հարցման կատարման պլանը Oracle-ում: Ինչպե՞ս է տարբեր EXPLAIN PLAN-ը և EXPLAIN ANALYZE-ը։
Խոսեք ձեր աշխատանքի մեջ PL/SQL պրոցեդուրաների օգտագործման մասին։
Ինչ է broadcast join-ը Spark-ում։
Դուք ունե՞ք Spark առաջադրանքների օպտիմալացման փորձ: Կարող եք տալ կոնկրետ օրինակ:
Կարո՞ղ եք երբևէ գրել փաթեթներ Oracle-ում։
Դու աշխատե՞լ ես ինկրեմենտալ և լրիվ բեռնումների հետ: Ինչպե՞ս պայքարեցիր կրկնօրինակների դեմ։
Ինչպե՞ս կարդալ HDFS- ի ֆայլը, օրինակ Parquet — ամբողջությամբ կամ բլոկներով:
Ի՞նչն է տարբերությունը RANK և DENSE_RANK-ի միջև։
Ի՞նչ է սյունային պահպանումը՝ համեմատած տողային պահպանումին:
Կարող եք բացատրել Oracle-ի բաժանումը՝ ինչու է այն օգտագործվում և ինչ տեսակներ կան։
Ինչպես է աշխատում բաժանումը Hive-ում և ինչպես է այն ֆիզիկապես ներկայացված ֆայլային համակարգում?