Czym różni się boosting od baggingu?
Machine Learning / AI
Opisz swojego agenta analitycznego: co robił, dla kogo, jak wyglądał proces pracy użytkownika?
Czy znasz GigaChat? Czy masz doświadczenie w pracy z nim?
Jak LLM wywołuje narzędzia lub MCP, jeśli je mamy?
Co zrobić ze skanami — jak wyciągnąć z nich tekst?
Ile dokumentów trzeba zautomatyzować — około 1000. Jak podejść do przetwarzania?
Jak są trenowane modele osadzeń? Jak napisałbyś własny embedder?
Czy pracowałeś z programowaniem obiektowym?
Jak zautomatyzowałbyś podział na kawałki przy objętości danych 10 gigabajtów?
Na czym polega zasadnicza różnica między DBSCAN a K-Means?
Jakiego modelu open source użyć do lokalnego uruchomienia przez Ollama?
Sformułuj Twierdzenie o granicznym rozkładzie.
Jak ocenić jakość wyszukiwania w bazie danych wektorowych bez oznaczeń?
Jak ocenić odpowiedzi LLM, jeśli są poprawne, ale napisane inaczej?
Gdzie jest przechowywany i jak wyświetla się prompt w systemie monitorowania?
Czy można rozwiązać problem obliczeniowy w SQL bez użycia funkcji okienkowych? Czy będzie to szybsze czy wolniejsze?
Jak zbudować wysokiej jakości pulę pytań i odpowiedzi do oceny systemu?
Jak napisałbyś logikę ponawiania prób podczas komunikacji z LLM? Czy znasz bibliotekę Tenacity?
Jak zaimplementowałeś Graph RAG? Dlaczego użyłeś Qdrant, jeśli nie obsługuje on natywnie grafów?
Jaka jest szybkość generowania tokenów (tokens na sekundę) w modelu Qwen?