Gyakorlati feladat
Az AI javasolja, hogy a LoRA-t minden 2 millió nem tisztított párbeszéden tanítsuk. Melyik a legérettebb válasz a jelölt részéről?
- Bízzunk az AI-ban: egy nagy korpusz kiegyenlíti a hibákat.
- Először változtassuk meg a promptot anélkül, hogy az adatokat módosítanánk.
- Tanítsuk a LoRA-t a tisztított részen, és hasonlítsuk össze az alapmodellel.
- Ellenőrizzünk egy véletlenszerű mintát a címkézésből az edzés előtt.
- Először ellenőrizzük az adatokat és a minőséget témák szerint egy külön készleten, majd korlátozottan tanítsuk a LoRA-t.
- Tanítsuk az egész korpuszon, de csökkentsük a LoRA rangját.