As-tu utilisé XCom dans Airflow?
Data Engineer
Pouvez-vous expliquer le partitionnement dans Oracle : à quoi cela sert-il et quels sont les types ?
Quand peut-on utiliser la famille de formats CSV?
Peut-on voir le schéma de la table avant d'exécuter la requête dans Hive ?
Le plan d'exécution d'EXPLAIN correspond-il toujours à ce qui est réellement exécuté?
Qu'est-ce qu'une vue (VIEW) et une vue matérialisée (MATERIALIZED VIEW) dans Oracle ? Comment les données sont-elles mises à jour dans une vue matérialisée ?
Quels autres formats de fichiers, en plus de Parquet, fonctionnent bien avec Hadoop et Hive?
Parle-moi de ton projet précédent, quelles étaient tes responsabilités?
Quelles sont les opérations paresseuses dans Spark et à quoi servent-elles?
Pourquoi sépare-t-on les vues (VIEW) et les tables ? À quoi servent les vues ?
Avez-vous déjà travaillé avec Oracle Data Integrator (ODI) ?
Comment votre expérience correspond-elle aux responsabilités du poste : accompagnement et analyse des processus de chargement, surveillance et détection d'anomalies, tests et déploiement de modifications en production, support de deuxième ligne, vérification de la documentation technique?
Comment connaître le plan réel d'exécution d'une requête dans Oracle?
Quels sont les avantages et inconvénients des systèmes de bases de données distribués?
Quelle est la différence entre la multithreading et le multiprocessus ? Pour quelles tâches utiliser les threads et pour quelles processus ?
As-tu travaillé avec le chargement par lots ou le streaming?
Pouvez-vous vous rappeler votre expérience en optimisation de requêtes ? Comment avez-vous agi, analysé ?
Quelle était votre architecture sur le projet ? DWH ou autre chose ?
As-tu travaillé avec des fonctions de fenêtre ? Quels types de fonctions de fenêtre connais-tu ?
Il y a eu une requête analytique lente dans Hive. Comment comprendre ce qui s'est passé et comment la réparer?