Praktische opdracht
AI stelt voor om LoRA te trainen op alle 2 miljoen ongereinigde dialogen. Wat is het meest volwassen antwoord van de kandidaat?
- Vertrouwen op AI: een grote corpus zal fouten compenseren.
- Eerst de prompt wijzigen zonder de gegevens te veranderen.
- LoRA trainen op het gereinigde deel en vergelijken met het basismodel.
- Een willekeurige steekproef van de annotatie controleren vóór training.
- Eerst de gegevens en kwaliteit per onderwerp controleren op een aparte set, daarna beperkt trainen van LoRA.
- Trainen op de hele corpus, maar de rang van LoRA verminderen.