Machine Learning / AI
Welke andere metrics moeten we toevoegen om de update van documenten te monitoren (zodat we niet ontdekken dat er na de update 3 documenten overblijven in plaats van 10.000)?
Waarom overweeg je momenteel andere aanbiedingen en denk je aan van baan veranderen?
Wat overweeg je, welke profielen van vacatures zouden je interessant vinden?
Vertel over de grootste/omvangrijke taak
Werkte de LLM als een dynamische RAG?
Wat is LayoutLM en hoe verschilt het van BERT voor documenten?
Wat is de methode van maximum likelihood? Hoe wordt daaruit Log Loss afgeleid?
Wat te doen als de interne toestand van het model in tegenspraak is met wat er in de context is?
Wat zijn positionele embeddings?
Wat is de complexiteit van de analytische oplossing van lineaire regressie en wanneer is deze instabiel?
Wat is het verschil tussen een cross-encoder (ranker) en een bi-encoder?
Vertel me over je werkervaring in Data Science.
Hoe krijg je een geformaliseerde, gestructureerde reactie, bijvoorbeeld bij het gebruik van gestructureerde output?
Waarom wordt de F1-score gebruikt in plaats van het rekenkundig gemiddelde van Precision en Recall?
Hoe zou je een experiment uitvoeren: alleen met historische gegevens of via een A/B-test in productie?
Vergelijk lineaire en niet-lineaire modellen in klassiek ML — voor- en nadelen.
Voor het genereren van vragen heeft het grote taalmodel moeite om de stijl te behouden bij zeldzame onderwerpen. De AI-assistent stelt voor om onmiddellijk LoRA te starten op de hele historische corpus van 2 miljoen dialogen, maar de annotatie is gedeeltelijk ruisend. Waar zou je deze raad niet vertrouwen en wat zou je als eerste kiezen?
Vertel over het clusteringproject van verzoeken met markering op basis van zakelijke belangrijkheid.
Hoe gaan we de dataset samenstellen om deze ranker te trainen?
Als de worker synchon is, zal hij batching hebben?