Wat is de contextlengte en waarom is het moeilijk uit te breiden?
Machine Learning / AI
Welke prompt compressietechnieken kent u (LLMLingua)?
Wat is overfitting en hoe er mee om te gaan?
Wat zijn de oorzaken van overfitting?
Welke methoden kunnen worden gebruikt om het model te verbeteren?
Wat is autocorrelatie en partiële autocorrelatie (ACF, PACF)?
Hoe evalueer je de mediane responstijd van de service bij een grote hoeveelheid logs die niet in het geheugen passen?
Hoe kies je gegevens om de mediaan te schatten: een sequentiële doorloop of een willekeurige steekproef?
Welke soorten regularisatie zijn er en hoe werken ze?
Wat is een experience replay buffer en waarom is het nodig?
Waarom kunnen de gewichten van het model groot worden en waarom is het nodig om ze te verminderen met regularisatie?
Wat is de visualisatie van de feature space van een CV-model met t-SNE/UMAP?
Hoe organiseer je containerisatie en deployment van modellen?
Wat is calibratie en waarom is het belangrijk voor eerlijkheid?
Wat is Medusa en multi-token voorspelling hoofden?
Vertel over de taak van automatische vertaling. Wat is sequence-to-sequence?
Wat is NCCL en waar is het verantwoordelijk voor?
Welke soorten fouten zijn er in medische protocollen en hoe worden ze getypeerd?
Ontwerp een OCR + NLP-systeem voor het verwerken van scans van contracten.
Hoe test je een LLM-agent (deterministische tests, replay, gemockte tools)?