Sobes.tech

Data Engineer

Parlez-moi de Greenplum — formats de stockage des données, stockage en ligne et en colonnes.

185

Qu'est-ce que ACID ? Que signifie chaque lettre ? Comment cela se rapporte-t-il aux transactions ?

184

Tu as mentionné les processus Docker, peux-tu m'en dire plus sur comment cela est organisé chez vous?

179

As-tu déjà travaillé avec des images Docker, en configurant un environnement sur une machine virtuelle?

179

Quelles sont les limitations de l'utilisation des tables de hachage?

175

Quels sont les types de connexions physiques (méthodes de jointure) ?

174

Comment est organisée votre assurance qualité (contrôle de la qualité des données) ?

174

Quelle est la différence entre refactoring et optimisation?

172

Qu'est-ce qu'un plan de requêtes ? À quoi servent-ils ?

170

Parlez-moi de votre expérience avec les bases de données distribuées (Greenplum, ClickHouse) ?

169

Avez-vous déjà travaillé avec Table Engine Join dans ClickHouse?

169

Supposons que Data Vault n'est pas disponible et qu'il y a deux grandes tables à joindre. Comment optimiseriez-vous cela dans Greenplum ? Et si c'était dans ClickHouse ?

169

Avez-vous de l'expérience avec des moteurs comme Trino ou avec des formats tabulaires (Iceberg, Parquet) dans Spark?

166

Qu'est-ce qui ne vous plaît pas actuellement dans votre travail?

166

Peut-on envisager autre chose qu'un CTE classique, étant donné que le filtrage se fait toujours en mémoire sur toute la table?

163
/3