Machine Learning / AI
Hoe verschillen mean/max pooling van learnable pooling?
Hoe kies je de grootte van de embedding vector?
Wat is NSP (volgende zin voorspelling) en waarom heeft RoBERTa het afgewezen?
Wat zijn de beperkingen van Whisper en hoe kun je ze omzeilen (lange vorm, hallucinaties)?
Wat is LoRA en waarom werkt het (laag-rang hypothese)?
Wat is meta-prompting en wat zijn de use-cases?
Waarom is bias=False nodig bij lineaire lagen in moderne LLM's?
Wat is cross-encoder QA en wat is het invoerformaat?
Wat is beam search en waarom wordt het zelden gebruikt voor open-ended generatie?
Welke compressieformaten (binair, scalare kwantisatie) zijn er in VDB?
Wat is de rol van payload-filters in de vector database?
Wat is een filterbubbel en hoe wordt deze gedetecteerd?
Wat is het idee achter het Byte Pair Encoding (BPE) algoritme? Beschrijf de trainingsstappen.
Wat is DocVQA en welke modellen zijn daar populair?