Sobes.tech

Machine Learning / AI

Jak funguje tokenizace? Proč se používají subword tokeny místo celých slov?

Middle+
216

Povězte o BGE-M3: tři reprezentace — hustá, řídká, více-vektorová.

Middle+
184

Co jsou Recall a Precision? Úloha: 50 kusů ovoce, 30 jablek a 20 hrušek, robot správně našel 20 jablek, ale 15 hrušek nesprávně identifikoval jako jablka. Spočítejte metriky.

Middle+
171

Znáte LoRA a metody doladění?

Middle+
168

Jak byly vybrány koeficienty pro hybridní hledání?

Middle+
164

Proč jste potřeboval 12 000 párů otázka-odpověď, když bylo jen 15 šablon?

Middle+
151

Proč jste rozpoznával dokumenty jako obrázky místo toho, abyste vytvořili parser?

Middle+
148

Jak jste sestavili testovací sadu dat: ze stejných 12 tisíc párů nebo z nových dat?

Middle+
142

Povězte nám o shlukování: jaký problém jste řešili, jakou metodu jste použili, jak jste měřili kvalitu?

Middle+
140

Jak funguje transformátor? Povídej mi o BERT a GPT.

Middle+
138

Co je hustý vektor (dense embedding)? Jak se získává? Jaká je jeho velikost?

Middle+
137

Jak jste hodnotili kvalitu systému RAG? Jaké metriky jste použili?

Middle+
137

Co je to cross-encoder a kde jste ho použili?

Middle+
135

Jaké modely byly použity v každé fázi? Pro extrakci entit, pro vektorizaci, pro generování?

Middle+
135

Co bylo odesíláno koncovému uživateli ve vašem systému?

Middle+
133

Proč je třeba zmenšit velikost slovníku? Čím je špatný velký slovník? V jaké funkci dochází k zatížení?

Middle+
133

Co je to sparse vektor? Čím se liší od hustého vektoru?

Middle+
133

Jaký je rozdíl mezi požadavky GET a POST?

Middle+
130

Pro jednom dotazu stačí jedna z 12 tisíc odpovědí nebo více?

Middle+
123

Vysvětlete jednoduchými slovy, jak váš systém funguje pro jednoho uživatele, bez asynchronnosti.

Middle+
123