Data Engineer
Odatiy ravishda pipeline'larda xatoliklar va ogohlantirishlarni qanday boshqargansiz?
# nima chiqariladi s = 'abracadabra' print(s[5][0][0][0]) print(s[::-2]) s = [1, 2, 3] print(s * 2)
PostgreSQLda SELECT * FROM [jadval] so'rovini bajarilgach nima bo'ladi?
# nima chiqaradi s = 'Abracadabra' print(s[5][0]) b = 'a' b[0] print(s[::2]) s = [1, 2, 3] print(s * 2)
ClickHouse'dagi Distributed dvigatelining qaysi parametrlar bilan tanishsiz?
Qanday qilib kodda qiymatning odatiy (kutilyotgan) taqsimotdan sezilarli darajada farq qilayotganligini tekshirishni tasvirlaysiz?
Agar noto'g'ri ma'lumotlar vitrina yoki oraliq jadvalga yuklangan bo'lsa, ularni yuqori pipeline'ga o'tishini qanday oldini olish mumkin?
Statistik tekshiruvlarni qildingizmi?
Greenplum bilan ishlashda qanday muammolarga duch keldingiz?
Greenplum'da INSERT, UPDATE va DELETE paytida nima bo'ladi; nima uchun DELETE dan so'ng disk joyi bo'shatilmaydi va DELETE bilan TRUNCATE o'rtasidagi farq nima?
ETL va ELT davrida saqlash uchun hisoblash quvvati talablar qanday farq qiladi?
2021 va 2022 yillar uchun "zarur bo'lgan kategoriya mahsulotlari" va "buyurtma bo'yicha buyurtmalar soni" ni ko'rsating (yakuniy ko'rinish: 2 qator. Maydonlar: yil, mahsulotlar soni, buyurtmalar soni) with cte as( select year(o.order_date) as year_orders, g.cat_1, count(distinct o.order_id) as count_orders, sum(g.quantity) as count_quan from Orders o join Goods g on o.order_id = g.order_id where (g.cat_1 = 'Kiyim' and Year(o.order_date) = 2021) or (g.cat_1 = 'Kiyim' va Year(o.order_date) = 2022) group by year_orders, g.cat_1 ) select year_orders, count_quan, count_orders from cte 2025 yil uchun, har bir kategoriya bo'yicha eng ko'p sotilgan model 3 ta with cte as( select cat_1, price, quantity, model, rank() over(partition by cat_1) as rk from Orders o join Goods g on o.order_id = g.order_id where Year(o.order_date) = 2025 ) 2025 yil uchun, har bir kategoriya bo'yicha eng ko'p sotilgan model 3 ta with cte as( select g.cat_1, g.model, (price * quantity), rank() over(partition by g.cat_1) as rk from Orders o join Goods g on o.order_id = g.order_id where Year(o.order_date) = 2025 ) with cte as( select g.cat_1, g.model, sum(price * quantity) as sum_, rank() over(partition by g.cat_1 order by sum() desc) as rk from Orders o join Goods g on o.order_id = g.order_id where Year(o.order_date) = 2025 ) with cte1 as( select g.cat_1, g.model, sum(price * quantity) as sum_total, from Orders o join Goods g on o.order_id = g.order_id where Year(o.order_date) = 2025 ), cte2 as(select g.cat_1, g.model, sum_total, rank() over(partition by g.cat_1 order sum_total desc) as rk from cte1 ) select g.cat_1, g.model, sum_total from cte2 where rk <=3 kategori nomi, model va umumiy sotuvlar (eng yaxshi 3) with cte1 as( select g.cat_1 as cat_name, g.model as model, sum(price * quantity) as sum_total, from Orders o join Goods g on o.order_id = g.order_id where Year(o.order_date) = 2025 group by Year(o.order_date), g.model ), cte2 as(select cat_name, model, sum_total, rank() over(partition by cat_name order sum_total desc) as rk from cte1 ) select cat_name, model, sum_total from cte2 where rk <=3
Apache Spark'da RDD nima va u Spark ning boshqa abstraktsiyalaridan qanday farq qiladi?
Nega siz reytingni alohida CTE ga chiqarishga qaror qildingiz? Nega uni birinchi CTE da darhol ishlatib bo'lmasdi?
Python'da dekoratorlar nima?