Sobes.tech

Machine Learning / AI

Prečo môže kvantizovaný LLM fungovať rýchlejšie a prečo niekedy kvantizácia naopak spomaľuje inferenciu?

Senior
144

Popíšte krok za krokom cestu používateľskej správy cez LLM pri inferencii — od chatu po odpoveď, vrátane architektonických detailov Transformera.

Senior
143

Aké nástroje AI používate denne?

Senior
139

Prečo je kešovanie presných používateľských dopytov zvyčajne obmedzenou obchodnou hodnotou a čo ste presne mali na mysli pod kešovaním odpovedí?

Senior
135

Ako dlho trval vyhľadávanie / úplný cyklus odpovede v RAG systéme?

Senior
133

Povedz mi o svojich projektoch: čo si presne robil, technicky podrobne?

Senior
132

Aké sú rozmery logitov a ako z nich vznikne token?

Senior
131

Čo dostáva LLM na výstupe pri každom kroku inferencie?

Senior
129
/2