Маалыматтар базаларындагы индекстер эмне, алар эмне үчүн керек жана алардын ички түзүмү кандай?
Data Engineer
Акыркы жумуш орундарындагы тажрыйбаң жөнүндө айтып бер, кайсы долбоорлор, кайсы стек?
UNION жана UNION ALL ортосунда кандай айырма бар? Канча шарттар аткарылышы керек?
Кайсы SQL операторлорунун топторун билесиң? Алар эмне үчүн тиешелүү?
Hash Join кантип иштейт?
Sparkтеги Catalyst оптимизатору эмне жана ал кандай конкреттүү оптимизацияларды жасайт (мисалы, predicate pushdown)?
Неге deadlockтар пайда болот жана маалыматтардын туруктуулугун камсыз кылган механизмдер кайсылар?
SASтан DBTга pipeline которууда маалыматтын тактуулугун кантип текшересиз?
Маалыматтардын сапаты боюнча окуялар менен иштедиңби?
Нормализация деген эмне? Биз негизинен кайсы формада иштейбиз?
Неге дәл ушул DBT-ны тандадыңыз? Бул frameworkтин кандай артыкчылыктары жана кемчиликтери бар деп ойлойсуз?
Маалыматтын сапаты (Data Quality) текшерүүлөр кай жана кайсы кадамда жүргүзүлөт, кандай текшерүүлөр болот жана жараксыз маалыматтар менен эмне болот?
Компанияда акыркы 2,5 жылда кызыктуу тапшырма тууралуу айтып бериңиз, мисалы, ClickHouse менен байланыштуу.
Pythonдеги Set жана Listтин өзгөчөлүктөрү жана айырмачылыктары эмнеде? Аткаргандан тышкары, дагы кандай өзгөчөлүктөр бар?
Merge Join (жыйындысы менен бириктирүү) кантип иштейт?
SQL сурооңузда SELECT, FROM, WHERE, GROUP BY, HAVING, ORDER BY, LIMIT операцияларынын аткаруу тартибин биринчи кезектен акыркыга чейин тизмелеңиз.
Сен эксперт катары жеке иштегиң келеби же иштеп чыгуучулардын командасындабы?
Greenplumта BY column жана RANDOMLYдан башка кандай бөлүштүрүү форматтары бар?
Бизде кардарлар таблицасы (ид, аты, дареги жана башка), товарлар (ид, аты жана башка), товар кыймылы (мында кардар ид, товар, дата, көлөм, сумма), 1-январда сатылган товарларды табышимиз керек, тек уникалдар жана ошондой эле сатып алуучунун атын жана...
Неге азыр жаңы жумуш издеп жатасың, жумушуңду алмашкың келеби?