Wat doe je meestal nadat je de SQL voor het DBT-model hebt klaarstaan?
Data Analyst
SQL-taak: bereken de conversie per experimenteergroepen (exp_id=90) van het Epic Match Start-naar Epic Fight Win-gebeurtenis per gebruiker, met correcte toewijzing van gebeurtenissen aan het experiment via join op tijd.
Python-opdracht: bouw gebruikerssessies op basis van gebeurtenissen (onderbreking > 30 minuten = nieuwe sessie) en bereken dagelijkse aggregaten.
Vertel over indexen in ClickHouse.
Wat is een semi-join en anti-join? Waarvoor dienen ze en waar worden ze toegepast?
Geef een voorbeeld van wanneer je zelf wijzigingen hebt geïnitieerd in DWH, pipeline of datamodel.
ORDER BY en PRIMARY KEY in ClickHouse — wat is het verschil, waarom zijn ze gescheiden?
Hoe bepaal je welke tests je moet schrijven voor het DBT-model? Zijn alerts nodig?
We hebben ClickHouse en daarin staat een DBT-query die regelmatig wordt uitgevoerd, maar lang duurt. Wat kunnen de oorzaken zijn en hoe zou je de optimalisatie aanpakken?
Vertel over benaderingen voor het bouwen van DWH: Data Vault 2.0 vs sneeuwvlok/ster — belangrijkste entiteiten, voordelen en nadelen.