Sobes.tech
Senior

Proč může kvantizovaná LLM fungovat rychleji a proč někdy kvantizace naopak zpomaluje inference?