Machine Learning / AI
Hogyan csökkenthető a KV-cache mérete (GQA, MQA, csúszó ablak)?
Hogyan profilozzuk az LLM inferenciát GPU-n (nsight, torch profiler)?
Mi az a Precision és Recall?
Miért ritkán használják a szigmoid függvényt aktivációs függvényként neurális hálózatokban?
Mi történik, ha eltávolítjuk az első vagy utolsó fát a boostingban?
Mi az NDCG és hogyan számítják ki?
Mi a gradiens képlete az MSE esetén a súlyokra?
Mi azok a meta-tanulók (S-learner, T-learner, X-learner, R-learner)?
Milyen use-k esetek az on-device LLM (Gemini Nano, Phi-3-mini)?
Hogyan egyensúlyozzuk a modell válaszsebességét és a modell méretét?
Mi a különbség a threading és a multiprocessing között Pythonban, és milyen feladatokra használják őket?
Hogyan végezhető kereszt-ellenőrzés időbeli sorozatokon?
Milyen feladatokat old meg a ML drónokban és autókban?
Milyen tulajdonságai vannak az osztályok kölcsönös kizárásának a többosztályos osztályozásban?
Mi az a szimulált relevancia visszacsatolás?
A keresési kérdések lehetőségei honnan származtak?
Miért szükséges egy mérőszám a rétegződéshez?
Milyen jellemzői vannak a címke zajtűrő tanulásnak?
Mi az a TF-IDF?
Mi az az FFN réteg a transzformátorban, és miért szükséges a nemlineáris működés az attention-blokkok között?