Работили ли сте с Kafka?
Data Engineer
Разкажи общо за опита си и какво си изучавал.
Защо реши да напуснеш текущия си проект? Какво те разочарова там?
Имал ли си ad-hoc задачи въпреки наличието на ясен технически задание, и как се отнасяш към ad-hoc заявки и промени в приоритетите?
Какви са вашите очаквания от нов проект?
Защо напускате текущата си работа?
Как се различава Hive от Impala?
Изграждали ли сте табла за управление и работили ли сте с инструменти за визуализация на данни (BI инструменти)?
Запознат ли си с OLAP кубове? Когато работим с многомерни данни, подобни на сводна таблица в Excel, но за по-бързо взаимодействие с големи обеми данни.
Има ли функции и възможности в Greenplum, които не са в обикновения MySQL и други диалекти?
Разкажете ни как сте използвали Hadoop/HDFS/Hive.
Обикновено какво правехте в PostgreSQL? Създавахте индекси и какво още правехте в базата данни?
Имаме ORDER BY по брой поръчки, и има две поръчки с 5, още две с 3. Как ще се държат RANK() и DENSE_RANK()?
В кои случаи е най-подходящо Nested Loop Join?
В какъв ред се извършват основните операции в SQL: SELECT, FROM и т.н.?
Каква е разликата между VACUUM и VACUUM FULL в PostgreSQL?
Как беше реализиран персонализираният оператор на Airflow: чрез BashOperator?
В момента участвате в интервюта? Имате оферти или сте в последните етапи, особено в банките?
Разкажете ни за задачите си в Spark: какво сте написали, какви абстракции и операции сте използвали?
Срещали ли сте конфликти в екипа или с мениджър? Как се справихте с това? Дайте примери.