Ինդեքսները տվյալների բազաներում ինչ են, ինչու են անհրաժեշտ և ինչ է նրանց ներքին կառուցվածքը։
Data Engineer
Պատմիր քո աշխատանքային փորձի մասին վերջին տեղերում, ինչ նախագծեր, ինչ տեխնոլոգիական շերտ?
Ո՞րն է տարբերությունը UNION և UNION ALL-ի միջև: Ո՞ր պայմաններն են պետք ապահովել:
Ի՞նչ SQL օպերատորների խմբեր գիտեք: Դրանք ինչին են պատկանում?
Ի՞նչ է Catalyst օպտիմիզատորը Spark-ում և ինչ կոնկրետ օպտիմիզացիաներ է իրականացնում (օրինակ, predicate pushdown):
Ինչպես է աշխատում Hash Join-ը?
Ինչպե՞ս եք ստուգում տվյալների ճշգրտությունը SAS-ից DBT-ին փոխանցելիս։
Ինչու են առաջանում deadlock-ները և որ մեխանիզմ է պատասխանատու տվյալների համահունչության համար միաժամանակյա հարցումների ժամանակ բազաներում։
Դուք աշխատե՞լ եք տվյալների որակի միջադեպերի հետ։
Ի՞նչ է նորմալիզացիան: Որ ձևով ենք հիմնականում աշխատում?
Ինչու եք հենց DBT-ն ընտրել: Ինչ առավելություններ և թերություններ եք տեսնում այս շրջանակում:
Որ փուլում են կատարվում տվյալների որակի ստուգումները (Data Quality), ինչպիսի՞ ստուգումներ են կատարվում և ինչ է տեղի ունենում անվավեր տվյալների հետ։
Պատմեք ընկերությունում վերջին 2,5 տարվա ընթացքում հետաքրքիր առաջադրանքի մասին, օրինակ՝ կապված ClickHouse-ի հետ։
Ի՞նչ առանձնահատկություններ և տարբերություններ կան Set և List-ների միջև Python-ում: Բացի կատարողականությունից, ինչ այլ առանձնահատկություններ կան?
Ինչպես է աշխատում Merge Join (կապակցում սորտավորմամբ)?
Դու ավելի շատ նախընտրում ես աշխատել որպես փորձագետ՝ անհատապես, թե թիմով ծրագրավորողների?
Նշեք SQL հարցում գործողությունների կատարման հերթականությունը՝ SELECT, FROM, WHERE, GROUP BY, HAVING, ORDER BY, LIMIT՝ առաջինից մինչև վերջինը։
Greenplum-ում տարածման ձևաչափերը ինչպիսի՞ն են բացի BY column և RANDOMLY-ից։
Մեր մոտ հաճախորդների աղյուսակ կա (id, անուն, հասցե և այլն), ապրանքներ (id, անուն և այլն), ապրանքների շարժում (այստեղ ունենք հաճախորդի id, ապրանք, ամսաթիվ, քանակ, գումար), պետք է գտնենք, թե որ ապրանքները վաճառվել են 1 հունվարի, միայն եզակի, և նաև ցույց տալ գնորդի անունը և...
Ինչու՞ հիմա նոր աշխատանք եք փնտրում, ուզում եք փոխել աշխատանքը։