Sobes.tech
Senior

Jakie inne metody optymalizacji można zastosować, aby przyspieszyć inferencję lub przynajmniej umieścić model w 12 GB VRAM na RTX 3090?