Sobes.tech
Senior

Waarom kan een gekwantiseerde LLM sneller werken en waarom vertraagt kwantisatie soms juist de inferentie?