Mit használtak az index létrehozásához a RAG-ben?
Machine Learning / AI
Mit tegyünk a képzés végén?
Mi a különbség az adat párhuzamosság és a modell párhuzamosság között?
Hogyan lehet eredménylistát kiadni?
Miben különbözik a ROC-AUC más metrikáktól?
Mi az a sparse attention?
Mi az anchor jelentése a Triplet Loss-ban?
Mi a különbség a Margin Loss és a Triplet Loss között?
Mi az az epoch (korszak)?
Hogyan tanítják a rerankert?
Mi az n az figyelem összetettségének kontextusában?
Ha nincs referencia válasz, csak dokumentumok és kontextus van — hogyan értékeljük a rendszert és honnan szerezzük be a referencia választ?
Milyen típusú LLM-optimalizációk léteznek?
Mit lehet még a keresztentrópián kívül használni veszteségfüggvényként?
Mi változott az LLM-ben az eredeti transzformátorhoz képest?
Milyen figyelmi típus csökkenti az O(n²) alatti összetettséget?
Mi az a gradient checkpointing?
Mi a kvantálás?
Hogyan értékeljük az RAG-ot megvalósító ügynököt?
Mi történik, ha 10k token hosszú szekvenciát adunk a dekódernek, miközben a modellt 9k-n tanították?