Hoe kunnen gegevens worden overgebracht van een gematerialiseerde weergave in Greenplum naar ClickHouse?
Data Engineer
Wat was jouw rol in een team van 4 personen en hoe zie je je carrière over 3-4 jaar, welke doelen stel je?
Hoeveel downloads waren er in totaal — high-level jobs, threads?
Hoe goed bent u bekend met Python?
Er wordt veel geheugen gebruikt bij CTE — wat gebeurt er met de gegevens wanneer ons geheugenverbruik hoog is?
Grote opslag was — hoe moeilijk was het om het handmatig te onderhouden in volumes en objecten?
We leveren metadata aan de ingang, en deze creëert op basis hiervan een stroom — hoe zal dit het snel overzetten van bestaande stromen van oude systemen naar het geplande systeem mogelijk maken?
Wat betreft de query, kunnen we zien wat er met de gegevens gebeurt, inclusief welke soorten joins — welke soorten joins we daar kunnen zien?
Hoe gegevens van Kafka naar ClickHouse te laden via streaming voor realtime rapportage?
Welke lezing wordt gebruikt in ClickHouse?
Hoe werkte je met analytische functies (window functies)?
Met Kafka is niets moeilijk, het belangrijkste is het verwerken van gegevens — welke nuances moeten in overweging worden genomen?
Was er een leider of iemand anders die het team van 4 mensen leidde?
Hoe kunnen gegevens van Greenplum en Trino naar ClickHouse worden overgedragen?
De opslag is gebouwd volgens het Data Vault-schema — heb je het ook ontwikkeld, onderhouden? Heb je handmatig hubs, links toegevoegd?
Ken je een multithreaded, zeer snelle bibliotheek in Rust die Pandas kan vervangen voor Data Science en Big Data?
Heb je al enkele baanvoorstellen?
Tot welk type behoort Greenplum meer — OLTP of OLAP?
Wordt ACID nageleefd in Greenplum?
Wat is het verschil tussen een CTE en een subquery?