Sobes.tech

Machine Learning / AI

Hoe werkt tokenisatie? Waarom worden subword-tokens gebruikt in plaats van volledige woorden?

Middle+
211

Vertel over BGE-M3: drie representaties — dicht, zeldzaam, multi-vector.

Middle+
181

Wat zijn Recall en Precision? Probleem: 50 fruit, 30 appels en 20 peren, een robot vond correct 20 appels, maar herkende 15 peren als appels. Bereken de metrics.

Middle+
167

Bent u bekend met LoRA en fine-tuning methoden?

Middle+
163

Hoe zijn de coëfficiënten voor de hybride zoekopdracht gekozen?

Middle+
160

Waarom had je 12.000 vraag-antwoordparen nodig terwijl er maar 15 sjablonen waren?

Middle+
150

Waarom hebt u de documenten als afbeeldingen herkend in plaats van een parser te maken?

Middle+
147

Hoe hebt u de testset gevormd: uit dezelfde 12.000 paren of uit nieuwe gegevens?

Middle+
140

Vertel ons over clustering: welk probleem hebben jullie opgelost, welke methode hebben jullie gebruikt, hoe hebben jullie de kwaliteit gemeten?

Middle+
140

Wat is een dense vector (dense embedding)? Hoe wordt het verkregen? Wat is de grootte ervan?

Middle+
137

Hoe werkt een transformer? Vertel me over BERT en GPT.

Middle+
137

Welke modellen werden in elke fase gebruikt? Voor entiteitsextractie, voor vectorisatie, voor generatie?

Middle+
135

Wat is een cross-encoder en waar hebt u deze gebruikt?

Middle+
135

Hoe hebt u de kwaliteit van het RAG-systeem beoordeeld? Welke metrics hebt u gebruikt?

Middle+
134

Waarom moet de grootte van het woordenboek worden verminderd? Waarom is een groot woordenboek slecht? In welke functie vindt de belasting plaats?

Middle+
133

Wat werd er naar de eindgebruiker in uw systeem gestuurd?

Middle+
132

Wat is het verschil tussen GET- en POST-verzoeken?

Middle+
128

Wat is een sparse-vector? Hoe verschilt deze van een dense-vector?

Middle+
127

Leg uit in eenvoudige woorden hoe jouw systeem voor één gebruiker werkt, zonder asynchroniteit.

Middle+
121

Voor één verzoek, past één van de 12.000 antwoorden of meerdere?

Middle+
118