Czym jest długość kontekstu i dlaczego jest trudna do rozszerzenia?
Machine Learning / AI
Jakie techniki kompresji promptów znasz (LLMLingua)?
Czym jest przeuczenie i jak sobie z nim radzić?
Jakie są przyczyny przeuczenia?
Jakie metody można zastosować do ulepszenia modelu?
Czym jest autokorelacja i autokorelacja częściowa (ACF, PACF)?
Jak ocenić mediany czas odpowiedzi usługi przy dużej ilości logów, które nie mieszczą się w pamięci?
Jak wybierać dane do oszacowania mediany: przejście sekwencyjne czy losowa podpróbka?
Jakie są rodzaje regularyzacji i jak one działają?
Czym jest bufor powtórnego odtwarzania doświadczeń i do czego służy?
Dlaczego wagi modelu mogą stać się duże i dlaczego należy je zmniejszać za pomocą regularizacji?
Czym jest wizualizacja przestrzeni cech modelu CV za pomocą t-SNE/UMAP?
Czym jest kalibracja i dlaczego jest ważna dla sprawiedliwości?
Jak zorganizować konteneryzację i wdrażanie modeli?
Czym jest Medusa i wielo-tokenowe głowy predykcji?
Czym jest NCCL i za co odpowiada?
Opowiedz o zadaniu tłumaczenia maszynowego. Czym jest sequence-to-sequence?
Jak testować agenta LLM (testy deterministyczne, odtwarzanie, mockowane narzędzia)?
Jakie rodzaje błędów występują w protokołach medycznych i jak je klasyfikować?
Zaprojektuj system OCR + NLP do obsługi skanów umów.