Sobes.tech

Machine Learning / AI

Miért működhet gyorsabban a kvantált LLM, és miért lassítja néha a kvantálás éppen az inferenciát?

Senior
144

Írja le lépésről lépésre a felhasználói üzenet útját az LLM-en keresztül az inferencia során — a chat-től a válaszig, beleértve a Transformer architektúrális részleteit.

Senior
143

Milyen AI-eszközöket használsz naponta?

Senior
139

Miért kínál általában korlátozott üzleti értéket az pontos felhasználói lekérdezések cache-elése, és pontosan mit értett azon, hogy a válaszokat cache-eljük?

Senior
135

Meddig tartott a keresés / teljes válasz ciklus a RAG rendszerben?

Senior
133

Mesélj a projektjeidről: pontosan mit csináltál, technikai részletekben?

Senior
132

Mekkora a logits mérete, és hogyan lesz belőle token?

Senior
131

Mit kap az LLM kimenetként minden inferencia lépésnél?

Senior
131
/2