Sobes.tech
Senior

Welke optimalisaties voor inferentie van standaard LLM kunnen worden voorgesteld als de bedrijfs-GPT traag werkt?