Miben különbözik a mean/max pooling a tanulható poolingtól?
Machine Learning / AI
Hogyan válasszuk ki az embedding vektor méretét?
Mik Whisper korlátai, és hogyan lehet ezeket megkerülni (hosszú formátum, hallucinációk)?
Mi az NSP (következő mondat előrejelzése), és miért hagyta el a RoBERTa?
Mi az a LoRA és miért működik (alacsony rang hipotézis)?
Mi az a meta-prompting és milyen use-k esetekben használható?
Mi az a cross-encoder QA és mi a bemeneti formátum?
Tervezzen egy alacsony késleltetésű (<500ms) végponttól végpontig tartó hangalapú asszisztens rendszert.
Miért szükséges a bias=False a modern LLM-ek lineáris rétegeiben?
Mi az a beam search és miért használják ritkán nyílt végű generáláshoz?
Milyen tömörítési formátumok (bináris, skalár kvantálás) vannak a VDB-ben?
Mi az a DocVQA és milyen modellek népszerűek ott?
Mi a szerepe a payload-szűrőknek a vektorbázisban?
Mi az a filter bubble és hogyan detektálják?
Mi a Byte Pair Encoding (BPE) algoritmus ötlete? Írja le a tanulási lépéseket.