Mi az a kontextus hosszúsága, és miért nehéz bővíteni?
Machine Learning / AI
Milyen prompt tömörítési technikákat ismer (LLMLingua)?
Mi az a túlillesztés és hogyan küzdjünk ellene?
Mik az túlillesztés okai?
Milyen módszerek használhatók a modell fejlesztésére?
Mi az autokorreláció és részleges autokorreláció (ACF, PACF)?
Hogyan értékeljük a szolgáltatás medián válaszidejét, amikor nagy mennyiségű napló van, ami nem fér bele a memóriába?
Hogyan válasszuk ki az adatokat a medián becsléséhez: szekvenciális átmenet vagy véletlenszerű mintavétel?
Milyen típusú regularizációk léteznek, és hogyan működnek?
Mi az a tapasztalati újrajátszó puffer, és miért van rá szükség?
Miért lehetnek a modell súlyai nagyok, és miért kell őket regularizációval csökkenteni?
Mi az a t-SNE/UMAP vizualizáció a CV-modell feature space-ében?
Mi az a Medusa és a multi-token előrejelzési fej?
Hogyan szervezzük a konténerizálást és a modellek telepítését?
Mi a kalibrálás, és miért fontos az igazságosság szempontjából?
Meséljen a gépi fordítási feladatról. Mi az a sequence-to-sequence?
Milyen hibák fordulnak elő az orvosi protokollákban, és hogyan osztályozzuk őket?
Tervezzen OCR + NLP rendszert szerződések szkennelésének feldolgozására.
Mi az a túlélési függvény S(t)?
Mi az a NCCL és mire felelős?