Sobes.tech

Data Engineer

Разкажи за релационните бази данни като цяло — какво представляват?

183

Какво е ACID? Какво означава всяка буква? Как това се отнася до транзакциите?

182

Кога не ни трябва хранилище за данни?

179

Споменахте процесите Docker, можете ли да разкажете повече за това как е организирано при вас?

179

Какво е утиная типизация (duck typing)?

178

Имал ли си опит с Docker образи, настройване на среда на виртуална машина?

177

Какви са ограниченията при използването на хеш таблици?

175

Как е организирано вашето QA (проверка на качеството на данните)?

174

Каква е разликата между рефакторинг и оптимизация?

172

Какво е план за заявки? За какво са нужни?

170

Какви са видовете физически връзки (методи за свързване)?

170

Имаш ли опит с Table Engine Join в ClickHouse?

169

Разкажете ли ми за вашия опит с разпределени бази данни (Greenplum, ClickHouse)?

167

Представете си, че Data Vault не е наличен и има две широки таблици, които трябва да се свържат. Как бихте оптимизирали това в Greenplum? А ако беше в ClickHouse?

167

Какво не ти харесва в момента в работата ти?

166

Имате ли опит с двигатели като Trino или с таблицени формати (Iceberg, Parquet) в Spark?

166

Може ли да се измисли нещо друго вместо обикновен CTE, като се има предвид, че филтрирането все още се извършва в паметта върху цялата таблица?

163

За какво изобщо ви беше нужен Data Vault?

157

В каква среда беше стартиран Spark?

157
/3