Was unterscheidet das Mean/Max-Pooling vom lernbaren Pooling?
Machine Learning / AI
Wie wählt man die Größe des Einbettungsvektors aus?
Welche Einschränkungen hat Whisper und wie umgeht man sie (Long-Form, Halluzinationen)?
Was ist NSP (Next Sentence Prediction) und warum hat RoBERTa darauf verzichtet?
Was ist LoRA und warum funktioniert sie (niedrige Rang-Hypothese)?
Was ist Meta-Prompting und welche Anwendungsfälle gibt es?
Was ist cross-encoder QA und welches ist das Eingabeformat?
Entwerfen Sie ein Sprachassistenzsystem mit niedriger Latenz (<500 ms) End-to-End.
Warum ist bias=False bei linearen Schichten in modernen LLMs notwendig?
Was ist Beam Search und warum wird es selten für offene Generierung verwendet?
Welche Komprimierungsformate (binär, skalare Quantisierung) gibt es in VDB?
Was ist Quantisierung und welche Schemata gibt es (PTQ, QAT, AWQ, GPTQ, GGUF)?
Was ist DocVQA und welche Modelle sind dort beliebt?
Welche Rolle spielen Payload-Filter in der Vektor-Datenbank?
Was ist die Filterblase und wie wird sie erkannt?
Was ist die Idee des Byte Pair Encoding (BPE) Algorithmus? Beschreiben Sie die Trainingsschritte.