Sobes.tech

Machine Learning / AI

Ako funguje tokenizácia? Prečo sa používajú subword tokeny namiesto celých slov?

Middle+
211

Povedzte o BGE-M3: tri reprezentácie — hustá, riedka, multi-vektorová.

Middle+
181

Čo sú Recall a Precision? Úloha: 50 ovocia, 30 jabĺk a 20 hrušiek, robot správne našiel 20 jabĺk, ale 15 hrušiek nesprávne identifikoval ako jablká. Vypočítajte metriky.

Middle+
167

Poznáte LoRA a metódy ladenia?

Middle+
163

Ako boli vybrané koeficienty pre hybridné vyhľadávanie?

Middle+
160

Prečo ste potrebovali 12 000 párov otázka-odpoveď, keď bolo iba 15 šablón?

Middle+
150

Prečo ste rozpoznávali dokumenty ako obrázky namiesto vytvorenia parsera?

Middle+
147

Ako ste vytvorili testovací súbor údajov: z tých istých 12 tisíc párov alebo z nových údajov?

Middle+
140

Povedajte nam o klastrizaciji: kakšen problem ste rešili, katero metodo ste uporabili, kako ste merili kakovost?

Middle+
140

Čo je hustý vektor (dense embedding)? Ako sa získava? Aká je jeho veľkosť?

Middle+
137

Ako funguje transformátor? Povedz mi o BERT a GPT.

Middle+
137

Aké modely sa používali v každom kroku? Na extrakciu entít, na vektorové reprezentácie, na generovanie?

Middle+
135

Čo je to cross-encoder a kde ste ho použili?

Middle+
135

Ako ste hodnotili kvalitu RAG systému? Aké metriky ste použili?

Middle+
134

Prečo je potrebné zmenšiť veľkosť slovníka? Čo je zlé na veľkom slovníku? V ktorej funkcii dochádza k záťaži?

Middle+
133

Čo sa odosielalo koncovému používateľovi vo vašom systéme?

Middle+
132

Aký je rozdiel medzi požiadavkami GET a POST?

Middle+
128

Čo je sparse-vektor? Čím sa líši od dense?

Middle+
127

Vysvetlite v jednoduchých slovách, ako funguje váš systém pre jedného používateľa, bez asynchrónnosti.

Middle+
121

Pre jedného dopytu, vyhovuje jedna z 12 tisíc odpovedí alebo viac?

Middle+
118