Sobes.tech

Machine Learning / AI

Czy możesz wyjaśnić różnicę między cross-encoder a bi-encoder?

221

Czy istnieje sposób na sprawdzenie, czy wygenerowany tekst nie zawiera faktualnych błędów w porównaniu z oryginałem?

201

Jak ocenić, czy model osadzeń działa dobrze? Jakie metryki zostały użyte?

197

Jak wybrano strategię dzielenia na fragmenty (chunking) dla systemu RAG?

182

Jak dane z dokumentów PDF były wyodrębniane dla systemu RAG?

181

Jak przetestować zaimplementowaną usługę na FastAPI?

180

Opowiedz o metrykach wydajności ML-serwisu: opóźnienie, RPS, jak to było zorganizowane w twoim projekcie?

180

Opowiedz o parametrach generacji LLM: temperatura, top-k, top-p i inne.

168

Opowiedz o bazach danych wektorowych, jakie istnieją, czym się różnią, dlaczego wybrali pgvector?

167

Opowiedz mi o kwantowaniu modeli: czym jest, do czego służy, jakie są jego rodzaje?

163

Jak się mają Recall i Precision, czy można zwiększyć jedno, nie obniżając drugiego? Podaj przykłady zadań.

150

Jak zorganizowano dane do podsumowania dialogów i jak przebiegało szkolenie?

150

Która metoda kwantowania (int8 czy float) zepsuje jakość modelu mniej?

148

Opowiedz o najtrudniejszym zadaniu lub trudnościach w jednym z projektów.

144

Jak podszedłbyś do zadania podsumowania dialogu wielu osób z konferencji (np. 10 programistów na Slacku)?

144

Jaki model i podejście wybrać do przetwarzania dźwięku z konferencji (speech-to-text, diarization)?

137

Jak pracować z danymi prywatnymi podczas lokalnego wdrożenia systemu?

123

Dlaczego wybrano hybrydowe wyszukiwanie BM25 + osadzenia zamiast samej odległości kosinusowej?

119