Sobes.tech
Senior

Stel dat een analist een SQL-query heeft geschreven. Identificeer inefficiënties in de query en stel voor hoe deze te vermijden. De query voegt twee tabellen samen: - feitentabel 'events' met sleutel 'event_id' - referentietabel verkeersbron met sleutel 'referer_str' Beide tabellen bevatten miljarden records. select * from (select distinct e.event_id, e.user_id, e.category_id, e.location_id, s.source_name, s.medium_name, s.campaign_name, row_number() over(partition by e.event_id, e.user_id, e.category_id, e.location_id, s.source_name, s.medium_name, s.campaign_name) as rnk from events e left join traffic_source s on e.referer_str = s.referer_str where e.event_date = current_date() - 1 group by 1,2,3,4,5,6,7) t where rnk = 1