Jak wstępnie przetwarzać tekst: jakie słowa stop i interpunkcję usuwać, stosować stemming lub lematyzację?
Machine Learning / AI
Czym jest pseudo-relevance feedback?
Czym jest długoterminowa pamięć agenta i jak ją zbudować (podsumowanie, pamięć wektorowa)?
Czym jest analiza układu w dokumentach?
Jak przebiega onboarding i szkolenie nowych pracowników w projekcie?
Czym jest GPTQ i jakie podejście stosuje się do wyboru wag?
Czym jest wyszukiwanie międzymodalne?
Jak pracować z niepełnymi danymi z różnych serwerów i tabel?
Czym jest global average pooling i dlaczego zastępuje warstwę w pełni połączoną?
Jak zaimplementować scalanie dwóch posortowanych tablic w jedną posortowaną tablicę?
Jak wykorzystać klasyczne uczenie maszynowe do poprawy rozpoznawania produktów?
Czy są dostępne dane do sprawdzenia rozwiązania, czy trzeba samodzielnie tworzyć dane testowe?
Czym jest graf i jak jest reprezentowany dla sieci neuronowych (macierz sąsiedztwa, lista krawędzi)?
Jakie są specyficzne optymalizacje dla ARM (NEON)?
Jak powiązać paragony z produktami przy niepełnych danych?
Dlaczego można użyć drzewa decyzyjnego do klasyfikacji?
Czym jest Markov Decision Process (MDP) i jakie ma składniki?
Czym jest bounding box i jakie są dostępne formaty współrzędnych (xyxy, xywh, cxcywh)?
Czym jest pamięć współdzielona i dlaczego warto jej używać?
Czym jest Medusa i wielo-tokenowe głowy predykcji?