Sobes.tech
Senior

Milyen paramétereket kell használni az LLM inferencia memóriaértékeléséhez, és milyen architekturális optimalizációk csökkentik a KV-cache-t?