Sobes.tech
Senior

¿Qué otros métodos de optimización se pueden utilizar para acelerar la inferencia o al menos colocar el modelo en 12 GB de VRAM en una RTX 3090?