Pandas-ում կա մի սյունակ, որը տիպով int է, բայց մի տողում արժեքը բացակայում է (NULL): Ինչ տիպի տվյալներ կլինեն այդ սյունակում?
Python
Օգտագործե՞լ եք MyPy տիպերի ստուգման համար։
Ի՞նչն է ավելի արագ՝ read_sql-ը Pandas-ում, թե ուղղակի կապը տվյալների բազայի հետ։
Ով է փոխում կոնտեքստը ասինխրոն մոտեցման մեջ?
Ի՞նչ ֆրեյմվորկեր եք օգտագործել Python-ի կոդ գրելիս։
Կան 5 ծառայության օրինակներ, որոնց հետ կապված cron առաջադրանք կա: Ինչպե՞ս ապահովել, որ առաջադրանքը կատարվի միայն մեկ անգամ, ոչ թե 5 անգամ:
Կարող եք նկարագրել տեղադրման պայպլայնի քայլերը? Կոդի հանձնմանց սկսած՝ հետո ինչ է տեղի ունենում?
Ինչու է անհրաժեշտ տվյալների բազայի նորմալիզացիան: Ինչպե՞ս որոշել, թե որքան պետք է նորմալիզացված լինի սխեման:
Ինչպե՞ս վավերացնել FastAPI-ում մուտքային CSV/Parquet ֆայլը (պահանջվող սյունակների առկայություն, արժեքների տիրույթներ):
Ի՞նչն է տարբերությունը Python ցուցակի և NumPy զանգվածի միջև։
Ի՞նչ է սինխրոն և ասինխրոն միջսերվիս փոխազդեցության տարբերությունը: Ինչպես են դրանք իրականացնում:
Կարճ ներկայացրեք ինքներդ ձեզ՝ ով եք, ինչ փորձ ունեք, ինչու եք եկել։
Pandas-ում կա 5 միլիոն տող տվյալներ՝ ինչ անել, եթե 100 հազարն աշխատել է նորմալ, իսկ 5 միլիոնը՝ ոչ?
Կարո՞ղ է Airflow DAG-ում ցիկլ ստեղծել. ԹASK 3-ը վերադարձնում է կատարումը TASK 1-ին, երբ տվյալների քանակը բավարար չէ։
Ինդեքսները ինչու են անհրաժեշտ ռելացիոն տվյալների բազաներում (PostgreSQL): Երբ նրանք օգնում են և երբ վնասում են?
Համակարգի դիզայնը՝ երեք հաշվարկային ծառայություններ, յուրաքանչյուրը դիմում է տվյալների ծառայությանը, արդյունքները պետք է պահպանվեն և արագ ցուցադրվեն վեբ ինտերֆեյսում: Ինչպե՞ս կառուցել նման համակարգ՝ ապահովելով հաշվարկի կատարման երաշխավորությունը։
Ինչու է կրթական ընկերությունը GetPositive-ն անհրաժեշտ եղավ գրել բանկային տվյալների պահեստը:
Ի՞նչ տարբերություն կա ֆունկցիոնալ ծրագրավորման և օբյեկտ-կողմնորոշված ծրագրավորման միջև: Ինչ եք օգտագործում ձեր մոտեցման մեջ?
Ի՞նչ փաթեթի կառավարիչ եք օգտագործում:
Ինչպե՞ս փոխանցել մեծ տվյալների ծավալներ (միլիոնավոր տողեր) Airflow-ում։