Tarefa prática
A IA sugere treinar LoRA em todos os 2 milhões de diálogos não limpos. Qual é a resposta mais madura do candidato?
- Confiar na IA: um grande corpus compensará os erros.
- Primeiro alterar o prompt sem modificar os dados.
- Treinar LoRA na parte limpa e compará-la com o modelo base.
- Verificar uma amostra aleatória de marcações antes do treinamento.
- Primeiro verificar os dados e a qualidade por tópicos em um conjunto separado, depois treinar LoRA de forma limitada.
- Treinar em todo o corpus, mas reduzir o rango do LoRA.