Machine Learning / AI
Mesélje el a Longformer ötletét és a ritka figyelmet.
Mi az az OPQ és miért jobb, mint a PQ?
Hogyan használhatók az együttműködő módszerek az embeddingeken alapuló ajánlásokhoz?
Hogyan osztjuk fel az adatokat kereszt-ellenőrzéshez?
Milyen adattípusok léteznek Pythonban?
Mi az az empirikus Bayes?
Mi az a prompt injekció, és milyen támadásokat láttál a gyakorlatban?
Mi az a SASRec és mi az architektúrája?
Mi a kvantálás?
Mi az vizsgalehetőség?
Hogyan kezeljük az adatban lévő hiányzó értékeket, beleértve az időbeli sorozatokat is?
Hogyan valósítható meg egy mező hozzáadása a táblához számított adatokhoz?
Mi az a retrieval hibrid pontszámmal (sűrű + ritka), és miért keverjük?
Azt mondtad, hogy az eszközök csak olvasási módban vannak, nem volt írás a rendszerben?
Mi az a TimesNet?
Mik a fő csapdák a tabuláris DL vs GBDT benchmarkoknál?
Gyakorlati feladat A PyTorch-ban végzett LLM ellenőrzés két futtatás során különböző eredményeket ad. Melyik megoldás érettebb? - Aktiváld az eval()-t és hasonlítsd össze újra az eredményeket. - Növeld a tesztkészlet méretét. - Ismételd meg a futtatást és válaszd ki a legjobb eredményt. - Válts TensorFlow-ra anélkül, hogy az okot elemeznéd. - Fixáld a seed-et és tekintsd megoldottnak a problémát. - Ellenőrizd az eval(), no_grad(), seed, DataLoader és determinisztikus CUDA műveleteket.
Hogyan generáljunk számsorozatot SQL-ben?
Hogyan befolyásolja a jellemzők skálázása a modell tanulását?
Milyen regularizációs módszerek alkalmazhatók a neurális hálózatokra?