Tarea práctica
AI propone entrenar LoRA en los 2 millones de diálogos sin limpiar. ¿Cuál es la respuesta más madura del candidato?
- Confiar en AI: un gran corpus compensará los errores.
- Primero cambiar el prompt sin modificar los datos.
- Entrenar LoRA en la parte limpia y compararla con el modelo base.
- Verificar una muestra aleatoria de las etiquetas antes del entrenamiento.
- Primero verificar los datos y la calidad por temas en un conjunto separado, luego entrenar LoRA de manera limitada.
- Entrenar en todo el corpus, pero reducir el rango de LoRA.