Machine Learning / AI
Waarom is de sigmoidine nodig in logistische regressie? Wat stelt het je in staat te doen?
Waarom wordt LayerNorm toegepast op de laatste dimensie en niet op de batch?
Wat doe je in je huidige baan?
Welk model zou je kiezen voor een binaire classificatietaak (vectoren uit R^n, labels 0 en 1)? Leg uit waarom.
Hoe gaan we de logistische regressie trainen? Welke verliesfunctie gaan we gebruiken?
Wat te doen als de punten in de lijsten overeenkomen op basis van tijdstempel?
Welke methoden zijn goedkoper dan menselijke evaluatie (LLM-als-rechter, model-gegradeerd)?
Wat was het vanuit analytische taken? Bent u bekend met A/B-testen? Welke metrics hebt u gebruikt?
In welke richting wijst de gradient van de functie f(x) = 4x + 5 op het punt x?
-- 1.1 Wat toont de query: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign AS campaign -- 1.2 Hoe verandert het antwoord als je het type JOIN wijzigt naar LEFT? -- 1.3 Geef de uitvoeringsvolgorde van de operators in deze query. -- 2. De tabel campaigns is gecorrigeerd: duplicaten verwijderd, sleutel (PK) toegevoegd. -- Meer campagnes zijn uitgevoerd, door bugs begonnen gebruikers mislukte pogingen tot communicatie te krijgen, en sommigen konden het helemaal niet laten zien. -- Over de promotiecampagnes die naar gebruikers zijn gestuurd: -- 2.1 Schrijf een query die het aantal gebruikers toont dat succesvol communicatie heeft ontvangen voor elke campagne. -- 2.2 Pas de query aan om te tonen: het aantal gebruikers dat geen enkele succesvolle communicatie heeft ontvangen, voor elke campagne.
Wat is overfitting? Hoe het te detecteren en te voorkomen?
Hoe beïnvloedt de aanwezigheid van meerdere nullen in de lijst de beslissing?
// Een gesorteerde array a in niet-afnemende volgorde, de index van het element index en een geheel getal k. // Het is nodig om in welke volgorde dan ook k getallen uit de array te retourneren die het dichtst bij de waarde van het element a[index] liggen. // Beperkingen: // Arraygrootte 1 <= N <= 10^6; // Array-elementen: -10^9 <= a[i] <= 10^9; // Getal 0 <= k <= N; // Index van het element 0 <= index < N. // find_k_closest(a={2, 3, 5, 7, 11}, index=3, k=2) -> {5, 7}
-- # -- Marketeers starten promotiecampagnes in de app van de service. Er zijn twee tabellen: -- # -- campaigns - lijst van campagnes -- # -- - campaign - naam van de campagne -- # -- - action_type - type campagne: "push" of "banner" -- # -- communications - backend-logboek met de verzendingen van communicatie van deze campagnes naar de gebruikers -- # -- - user_id - gebruikersidentificatie -- # -- - campaign - naam van de campagne -- # -- - status - status van het evenement: "success" of "error" -- ------------------------------------------------------------------------------------------------------------------------ -- # -- 1. Aanvankelijk, in de tabel campaigns, zijn er 4 rijen: -- # -- | campaign | action_type | -- # -- |-------------|-------------| -- # -- | promo_dogs | push | -- # -- | promo_cats | banner | <- willekeurig gedupliceerd -- # -- | promo_cats | banner | <- twee rijen -- # -- | promo_rats | push | # # -- Daarnaast is bekend dat: -- # -- de campagnes promo_dogs en promo_cats succesvol zijn uitgevoerd bij 100 gebruikers, en elke gebruiker heeft één communicatie ontvangen, -- # -- terwijl promo_rats alleen gepland is. -- # -- 1.1 Wat zal de query tonen: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign -- # -- 1.2 Hoe zal het antwoord veranderen als het JOIN-type wordt gewijzigd in LEFT? -- # -- 1.3 Geef de uitvoeringsvolgorde van de operators in deze query. -- Antwoord: promo_dogs ... ...
Hoe uit je het aantal ballen in de tweede mand door het aantal ballen in de eerste?
-- 1.1 Wat toont de query: SELECT campaign, COUNT(*) as rows, COUNT(DISTINCT co.user_id) AS users FROM campaigns AS ca INNER JOIN communications AS co ON ca.campaign = co.campaign GROUP BY ca.campaign AS campaign -- 1.2 Hoe verandert het antwoord als je het type JOIN wijzigt naar LEFT? -- 1.3 Geef de volgorde van uitvoering van de operators in deze query. -- 2. De tabel campaigns is gecorrigeerd: duplicaten verwijderd, sleutel (PK) toegevoegd. -- Meer campagnes zijn uitgevoerd, door bugs begonnen gebruikers mislukte pogingen tot communicatie te krijgen, en sommigen konden helemaal niet worden weergegeven. -- Voorbeeld 1: communications -- | user_id | campaign | status | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | error | -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | success| -- | 1000001 | promo_cats | error | -- Voorbeeld 2: communications -- | user_id | campaign | status | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- | 1000002 | promo_rats | error | -- Over de promotiecampagnes die naar gebruikers zijn gestuurd: -- 2.1 Schrijf een query die het aantal gebruikers toont dat succesvol communicatie heeft ontvangen, voor elke campagne. -- 2.2 Pas de query aan om te tonen: het aantal gebruikers dat geen enkele succesvolle communicatie heeft ontvangen, voor elke campagne.
Welke regularisatiemethoden kent u? Hoe verschilt L1 van L2?
Schrijf de voorspellingsformule voor logistische regressie op.