On donne deux tables t1 et t2. La tâche consiste à énumérer tous les types de joins que vous connaissez et le résultat de la requête select * from t1 <join> t2 on t1.t = t2.t pour chacun d'eux. |t1.t| ------ 1 2 4 null ------ |t2.t| ------ 1 3 null null
Data Engineer
Parlez-nous de votre expérience avec Greenplum, DBT et Data Vault. Pourquoi êtes-vous passé du modèle en étoile au Data Vault?
Quelle est la différence entre une boucle sur une chaîne de caractères et une boucle sur un tuple en Python ? Quels types sont fondamentaux et comment cela influence-t-il la performance ?
Comparez deux solutions au problème de recherche d'unités par consommation de mémoire : 1) boucle avec variables, 2) split('0') + compréhension de liste + max()
Décrivez les méthodes d'optimisation des requêtes SQL que vous avez utilisées. Comment avez-vous réduit le temps d'exécution de 12-15 secondes?
Qu'est-ce qui vous motive dans votre travail ? Énumérez vos points forts en matière de compétences techniques.
Étant donné une chaîne de zéros et de uns. Il faut écrire une fonction func() qui renvoie le nombre maximum de uns consécutifs. Par exemple : func("010111011") -> 3
Il est donné deux tables t1 et t2. La tâche consiste à énumérer tous les types de jointures que vous connaissez et le résultat de la requête select * from t1 <join> t2 on t1.t = t2.t pour chacun d'eux. |t1.t| ------ 1 2 4 null ------ |t2.t| ------ 1 3 null null cross 1 1 - null null - INNER JOIN [phone] LEFT JOIN 1 - 1 2 - NULL 4 - NULL NULL - NULL RIGHT JOIN [phone] NULL - 3 NULL - NULL NULL - NULL FULL JOIN [phone] - NULL 4 - NULL NULL - 3 null - NULL null - NULL null - NULL
Quels types d'algorithmes JOIN existent dans PostgreSQL et en quoi Hash Join diffère-t-il de Nested Loop Join ? Dans quels cas Hash Join est-il inapplicable ?
Parlez-moi de la tâche la plus difficile ou intéressante que vous avez dû résoudre