Sobes.tech

Machine Learning / AI

Hogyan működik a tokenizálás? Miért használnak subword-tokeneket a teljes szavak helyett?

Middle+
205

Beszélj a BGE-M3-ról: három reprezentáció — sűrű, ritka, több-vektoros.

Middle+
181

Mi az a Recall és Precision? Feladat: 50 gyümölcs, 30 alma és 20 körte, egy robot helyesen talált 20 almát, de 15 körtét tévesen almának azonosított. Számolja ki a metrikákat.

Middle+
165

Ismeri a LoRA-t és a finomhangolási módszereket?

Middle+
162

Hogyan választották ki a hibrid kereséshez a koefficienseket?

Middle+
160

Miért volt szükséged 12 000 kérdés-válasz párra, ha csak 15 sablon volt?

Middle+
150

Miért ismerted fel a dokumentumokat képként, és nem készítettél parse-t?

Middle+
146

Hogyan alakítottad ki a tesztkészletet: ugyanabból a 12 ezer párból vagy új adatokból?

Middle+
140

Meséljen a klaszterezésről: milyen problémát oldottak meg, milyen módszert használtak, hogyan mérték a minőséget?

Middle+
140

Mi az a sűrű vektor (dense embedding)? Hogyan jön létre? Mekkora a mérete?

Middle+
137

Hogyan működik egy transzformer? Mesélj a BERT-ről és a GPT-ről.

Middle+
137

Milyen modelleket használtak minden szakaszban? Entitáskivonásra, vektorizálásra, generálásra?

Middle+
135

Hogyan értékelte a RAG rendszer minőségét? Milyen metrikákat használt?

Middle+
133

Mi az a cross-encoder, és hol használta?

Middle+
133

Mit küldött végfelhasználónak a rendszerében?

Middle+
132

Miért kell csökkenteni a szótár méretét? Miért rossz egy nagy szótár? Melyik funkcióban történik a terhelés?

Middle+
131

Mi a különbség a GET és POST kérések között?

Middle+
128

Mi az a sparse-vektor? Miben különbözik a dense-vektortól?

Middle+
126

Magyarázd el egyszerű szavakkal, hogyan működik a rendszered egy felhasználó számára, aszinkronitás nélkül.

Middle+
120

Egy kéréshez megfelel az egyik 12 ezer válasz vagy több?

Middle+
118