Sobes.tech

Machine Learning / AI

Jak działa tokenizacja? Dlaczego używa się subword tokenów zamiast pełnych słów?

Middle+
203

Opowiedz o BGE-M3: trzy reprezentacje — gęsta, rzadka, wielowektorowa.

Middle+
181

Czym są Recall i Precision? Zadanie: 50 owoców, 30 jabłek i 20 gruszek, robot poprawnie znalazł 20 jabłek, ale 15 gruszek rozpoznał jako jabłka. Oblicz metryki.

Middle+
165

Czy znasz LoRA i metody fine-tuning?

Middle+
162

Jak wybrano współczynniki dla wyszukiwania hybrydowego?

Middle+
160

Dlaczego potrzebowałeś 12 000 par pytań i odpowiedzi, skoro było tylko 15 szablonów?

Middle+
150

Dlaczego rozpoznawałeś dokumenty jako obrazy, zamiast stworzyć parser?

Middle+
146

Jak utworzyłeś zestaw danych testowych: z tych samych 12 tysięcy par czy z nowych danych?

Middle+
140

Opowiedz o klasteryzacji: jakiego problemu rozwiązaliście, jaką metodę użyliście, jak mierzyliście jakość?

Middle+
139

Czym jest gęsty wektor (dense embedding)? Jak jest uzyskiwany? Jaki ma rozmiar?

Middle+
137

Jak działa transformator? Opowiedz o BERT i GPT.

Middle+
137

Jakie modele używano na każdym etapie? Do wydobywania jednostek, do wektoryzacji, do generowania?

Middle+
134

Czym jest cross-encoder i gdzie go używałeś?

Middle+
133

Jak oceniłeś jakość systemu RAG? Jakie metryki użyłeś?

Middle+
132

Co było wysyłane do końcowego użytkownika w Twoim systemie?

Middle+
132

Dlaczego trzeba zmniejszyć rozmiar słownika? Dlaczego duży słownik jest złym rozwiązaniem? W jakiej funkcji dochodzi do obciążenia?

Middle+
131

Jaka jest różnica między żądaniami GET i POST?

Middle+
128

Czym jest wektor rzadki? Czym różni się od wektora gęstego?

Middle+
124

Wyjaśnij w prostych słowach, jak działa Twój system dla jednego użytkownika, bez asynchroniczności.

Middle+
120

Czy na jedno zapytanie pasuje jedna z 12 tysięcy odpowiedzi, czy wiele?

Middle+
118