Data Engineer
Ինչ հաճախ էին հաշվարկվում վիտրինները: Դա ինկրեմենտալ կամ լրիվ հաշվարկ էր:
Կամ կարող եք ունենալ Data Science ոլորտում փորձ — մոդելների, վիճակագրության հետ աշխատել?
Որ տվյալների աղբյուրների հետ եք աշխատել: Ինչպես տեղի ունեցավ փոխազդեցությունը աղբյուրների հետ?
Ինչ կարելի է ասել հետևյալ հարցման ճշգրտության մասին? select * from sessions where ended_at is null and status != 'pending';
Ի՞նչ ֆիզիկական ռազմավարություններ եք գիտակցում join-ի իրականացման համար։
Լոգիստիկ ընկերության համար զեկույց Դուք լոգիստիկ ընկերության վերլուծաբանի եք, որը վարում է պահեստների գործողությունների հաշվետվություն: Պատրաստեք յուրաքանչյուր պահեստի արդյունավետության մասին զեկույց: Հաշվեք յուրաքանչյուր պահեստի համար. • ընդհանուր գործողությունների քանակը (count_operations); • պահեստում մշակված ընդհանուր ապրանքների քանակը (sum_quantity); • գործողության միջին ժամանակը (avg_processing_time), հաշվի առնելով միայն նշված ժամանակով գործողությունները (ոչ NULL), կլորացրած ամբողջ թվով; • մեկ գործողության մեջ մշակված առավելագույն և նվազագույն ապրանքների քանակը (max_quantity, min_quantity); • յուրաքանչյուր տեսակի գործողությունների քանակը («մատակարարում», «ուղարկում», «փոխադրում») առանձին սյունակներում: supply_operations, shipment_operations, transfer_operations. Ֆիլտրեք պահեստները, որոնց ընդհանուր գործողությունների քանակը ավելի է, քան 2-ը և միջին ժամանակը չի գերազանցում 60 րոպեն: Արդյունքը դասավորեք պահեստի ID-ի աճման կարգով: Մուտքային ձևաչափ Գործողությունների աղյուսակ: • operation_id (int) — գործողության եզակի ID • warehouse_id (int) — պահեստի ID • operation_type (text) — գործողության տեսակ: «մատակարարում», «ուղարկում», «փոխադրում»
Ինչպես ապահովել հիմնական բանալի գլոբալ յուրահատկությունը PostgreSQL-ում sharding-ի ժամանակ?
Որ ֆիզիկական մեխանիզմը JOIN-ը կիրականացվի տրանսակցիոն աղյուսակն ու օրացույցի աղյուսակը միացնելու ժամանակ՝ պայմանով անհավասարության (թիվ <= թիվ)?
Ինչպես է աշխատում Nested Loop Join-ը և ինչ է նրա ալգորիթմական բարդությունը: Ինչ է բոլոր երեք ալգորիթմների բարդությունը?
Ի՞նչ ես գրել Python-ով, բացի Airflow DAG-ից։
Որ ֆիզիկական JOIN ալգորիթմները աշխատում են տվյալների բազաներում?
Խոսեք ձեր Python մակարդակի մասին՝ ինչ եք օգտագործել, որքան խորությամբ եք ճանաչում օբյեկտային ծրագրավորումը
Ինչպե՞ս բաժանել հարցումը փուլերի: Ինչ ենք անում դրա համար:
Ի՞նչ է ձեզ մոբիլիզացնում աշխատանքի ժամանակ: Նշեք ձեր ուժեղ կողմերը hard skills ոլորտում։
Ինչպես են կապված Spark-ի բաժանումները և աղյուսակների բաժանումները (օրինակ, Iceberg-ում):
Ի՞նչ սեղանի շարժիչներ եք ճանաչում և օգտագործել ClickHouse-ում։
Ինչ կարող ես ասել SOAP API-ի մասին?
Որ թիմում և որ ղեկավարության տակ եք ամենաշատ հարմարավետ զգում աշխատել?
Ի՞նչ է բերում Iceberg ձևաչափը սովորական Parquet-ի համեմատ։
Դուք գրել եք միավորային թեստեր: Ունե՞ք այդ փորձը։