Data Engineer
Oyna funksiyasi chegaralarida UNBOUNDED PRECEDING nima?
Indekslar har doim ishlashni yaxshilaydimi yoki degradatsiyaga olib keladimi?
ClickHouse'da jadvalni qanday yangilash mumkin, shunda foydalanuvchilar hech narsa sezmaydi (atomik o'zgartirish)?
Agar mijozlar bilan tranzaktsiyalarni client_id va date_start bo'yicha (BETWEENsiz) birlashtirsangiz, natijada nima olinadi?
Semantik versiyalash nima? Qachon major, minor, patch ni oshirish kerak?
So'rovni bosqichlarga qanday ajratamiz? Buning uchun nima qilamiz?
Ma'lumotlar sifatiga bo'lgan tushunchangiz haqida gapiring — bu sohada ishlash tajribangiz bormi?
Maxsus ketma-ketlik, nomi even_sequence bo‘lib, faqat juft sonlarni ishlab chiqaradigan, yaratildi. [...]-ning o‘rniga nima qo‘yish kerakki, agar even_column qiymati kiritilmagan bo‘lsa, qiymat even_sequence-dan olinadi? create table some_table( even_column [...] ); integer computed as nextval('even_sequence') integer generated always as identity (start with 2 increment by 2) integer default nextval('even_sequence') integer unique default nextval('even_sequence') integer generated by even_sequence’
Qaysi JOIN turlarini bilasiz? 2-3 asosiylarini tushuntiring.
Git Flow yangi ilovani chiqarishni qanday tavsiya qiladi? - Yangi issue-chiqish shoxobchasini yaratish - master-dan hotfix shoxobchasini yaratish - develop-dan alohida release shoxobchasini yaratish - master shoxobchasiga to'g'ridan-to'g'ri commit qilish - master shoxobchasini to'g'ridan-to'g'ri develop bilan birlashtirish
Ma'lumotlarni birlashtirish qaysi maydonlarda bo'ldi va ko'chirmalarni qanday olib tashladilar?
ETL va ELT davrida saqlash uchun hisoblash quvvati talablar qanday farq qiladi?
Ish tajribangiz haqida gapiring
Domain Driven Design (DDD) metodologiyasiga tanishmisiz? Agar ha, ularni loyihalaringizda qo‘llash misollarini bo‘lishing.
Qaysi quyidagi bayonot kengaytirilgan Git Flow va o'zgarishlar tarixini boshqarish nuqtai nazaridan bunday harakatlarning natijalarini aks ettiradi?
[ism] so'radi: Qaysi ustunlar Nullable bo'lishi kerak va bu DDLda qanday belgilanishi kerak?
Spark arxitekturasi qanday tuzilganligini umumiy tarzda tushuntiring: qaysi komponentlar mavjud va ular SQL so'rovini bajarishda qanday o'zaro ta'sir qiladi.
SQL va relational ma'lumotlar bazalari bilan qanday tajribangiz bor?
Logistika korxonasiga hisobot Siz logistika korxonasida omborlardagi operatsiyalarni hisobga oladigan tahlilchisiz. Har bir omborning samaradorligi haqida hisobot tayyorlashingiz kerak. Har bir ombor uchun hisoblang: • umumiy operatsiyalar soni (count_operations); • omborda ishlov berilgan umumiy mahsulotlar soni (sum_quantity); • faqat belgilangan vaqt bilan (NULL bo'lmagan) operatsiyalarni hisobga olgan holda, o'rtacha ishlov berish vaqti (avg_processing_time), butun son bilan yaxlitlangan; • bir operatsiyada ishlov berilgan maksimal va minimal mahsulotlar soni (max_quantity, min_quantity); • har bir turdagi operatsiyalar soni («yetkazib berish», «jo'natish», «otransfer») alohida ustunlarda: supply_operations, shipment_operations, transfer_operations. Umumiy operatsiyalar soni 2 dan ortiq bo'lgan va o'rtacha ishlov berish vaqti 60 daqiqadan oshmaydigan omborlarni filtrlash. Natijani ombor ID bo'yicha o'sish tartibida saralash. Kiritish formati Operationlar jadvali: • operation_id (int) — operatsiya identifikatori • warehouse_id (int) — ombor identifikatori • operation_type (text) — operatsiya turi: «yetkazib berish», «jo'natish», «otransfer»
CDC nima va uning bilan ishlash tajribangiz bormi?