Data Engineer
Hoe wordt een bestand uit HDFS gelezen, bijvoorbeeld Parquet — volledig of in blokken?
Wat zijn de beperkingen bij het gebruik van hashtabellen?
Hoe kan een SQL-injectie via het datuminvoerveld plaatsvinden?
Toetsing toont alleen REST-verzoeken of iets anders?
Wat doe je als je een probleem in de productie-pijplijn tegenkomt?
Wat zijn de nadelen van de MPP-architectuur in Greenplum?
Welke soorten fysieke verbindingen (join-methoden) zijn er?
Wat zijn uw salarisverwachtingen?
Waren er problemen met OpenAPI bij de overgang van Spring Boot 2 naar 3?
Hoe herstel je werk van een remote branch als je bij het proberen `git checkout hotfix/missing-footer` een foutmelding krijgt dat de branch niet gevonden is?
Welke soorten tabellen heb je in Greenplum gebruikt? In welke gevallen werd heap gebruikt en in welke Append-Optimized?
Waarvoor zijn indexen, wat zijn de voor- en nadelen?
Hoe werkt MapReduce, met name de Reduce-fase?
Wat gebeurt er bij het paralleliseren van queries in een enkele-node Postgres?
Hoe kunnen gegevens van Greenplum en Trino naar ClickHouse worden overgedragen?
Hoe werkte je met analytische functies (window functies)?
Hoe verschilt HDFS van gewone gedistribueerde bestandssystemen?
Welke voor- en nadelen van ACID kunnen worden genoemd, behalve de leessnelheid?
Dit is in realtime, hoe implementeer je dit tussen Kafka en ClickHouse Spark?
Wat zou je graag willen doen in ons team?