Sobes.tech

Data Engineer

Как работи оптимизаторът на заявки в Oracle, на какво обръща внимание и към кой клас принадлежи?

Middle
280

Какъв е смисълът от разделянето на данните на блокове в HDFS?

Middle
264

Как работехте с Impala?

Middle
241

Какво отличава HDFS от обикновените разпределени файлови системи?

Middle
226

Как работи MapReduce, по-специално етапът Reduce?

Middle
212

Какво е YARN и за какво е нужен?

Middle
205

Как работихте с CI/CD?

Middle
200

Как заредихте данни от S3 в Greenplum?

Middle
197

Какво е shuffle в Spark и защо е важно да го минимизираме?

Middle
190

Как да видите плана за изпълнение на заявка в Oracle? Какво е различното между EXPLAIN PLAN и EXPLAIN ANALYZE?

Middle
185

Разкажете за използването на PL/SQL процедури във вашата работа.

Middle
180

Какво е broadcast join в Spark?

Middle
177

Имали ли сте опит в оптимизацията на Spark задачи? Можете ли да дадете конкретен пример?

Middle
176

Имали ли сте някога нужда да пишете пакети в Oracle?

Middle
174

Работили ли сте с инкрементални и пълни зареждания? Как се справяхте с дублиращите се записи?

Middle
172

Какво е предимството на колонното съхранение пред редовото?

Middle
167

Каква е разликата между RANK и DENSE_RANK?

Middle
167

Как се чете файл от HDFS, например Parquet — цял или на блокове?

Middle
167

Разкажете за партиционирането в Oracle: за какво се използва и какви видове има?

Middle
162

Какво е Hive и как се различава от традиционните релационни бази данни?

Middle
160
/3