Machine Learning / AI
Geef een voorbeeld waarin verkeerd gebruik van BatchNorm in de `eval()`-modus heeft geleid tot fouten in de voorspellingen.
Vertel eens over jezelf: aan welke projecten heb je gewerkt, welke technologieën heb je gebruikt?
Vertel me in meer detail hoe de pipeline van het RAG-systeem (filtering, re-ranking) was opgebouwd, wat je persoonlijk hebt gedaan en wat je collega's?
-- 1.1 Wat toont de query: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign AS campaign -- 1.2 Hoe verandert het antwoord als je het type JOIN wijzigt naar LEFT? -- 1.3 Geef de volgorde van uitvoering van de operators in deze query. -- 2. De tabel campaigns is gecorrigeerd: duplicaten verwijderd, sleutel (PK) toegevoegd. -- Meer campagnes zijn uitgevoerd, door bugs begonnen gebruikers mislukte pogingen tot communicatie te krijgen, en sommigen konden helemaal niet worden weergegeven. -- Voorbeeld 1: communications -- | user_id | campaign | status | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | error | -- Voorbeeld 2: communications -- | user_id | campaign | status | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- Over de promotiecampagnes die naar gebruikers zijn gestuurd: -- 2.1 Schrijf een query die het aantal gebruikers toont dat succesvol communicatie heeft ontvangen, voor elke campagne. -- 2.2 Pas de query aan om te tonen: het aantal gebruikers dat geen enkele succesvolle communicatie heeft ontvangen, voor elke campagne.
Wanneer ben je klaar om aan het project te beginnen?
Vertel over de volledige cyclus van het lanceren van een product op een nieuwe markt bij [bedrijf]: wat verstaat u onder de volledige cyclus, welke fasen, metrics, resultaten
a = [1, 2, 3] b = [1, 2, 3] c = a print(a == b) print(a is b) print(a is c)
Wat anders, naast kruis-entropy, kan worden gebruikt als verliesfunctie?
Vertel iets over jezelf en je relevante ervaring.
Vertel over de hoofdarchitectuur van de transformer, wat zijn de belangrijkste onderdelen?
Wat kan er gedaan worden zodat het model niet antwoordt als er geen informatie in de context is om de vraag te beantwoorden?
Hoe veranderen positionele embeddings Q, K, V?
Vertel ons meer over de KV-cache: hoe het werkt en waar het vandaan komt, te beginnen met de Transformer-architectuur.
Is er een specifieke ontwikkelingsmethodologie (Agile, Scrum, Kanban)?
Waarom CatBoost in plaats van XGBoost of LightGBM? Wat zijn de verschillen?
Wat is voor jou belangrijk bij het kiezen van een nieuwe werkplek? Taken of werken in een productteam?
Vertel me over de generatieparameters: temperatuur, Top-P en Top-K.
Vertel over je ervaring in de context van de vacature Data Scientist.
Hoe hebt u de kwaliteit van de gegevensextractie gemeten?
Wat is RAG en wat zijn de belangrijkste componenten?