Dlaczego używać list do przechowywania poprzednich wartości?
Machine Learning / AI
Jak działa losowy las i jak jest trenowany w zadaniu klasyfikacji?
Jeśli AUC nowego modelu wynosi 0,82 w porównaniu do 0,80 w modelu starszym, czy można pewnie powiedzieć, że nowy jest lepszy? Jak sprawdzić istotność statystyczną?
Czy można uznać nowy model z wynikiem F1 0,81 za lepszy od modelu z 0,8 i od razu wdrożyć go do produkcji?
Jaka jest złożoność asymptotyczna przy wielokrotnych przejściach po liście?
Jak zmierzyć jakość modelu binarnej klasyfikacji? Jakie metryki znasz?
Czy należy regulować wyraz wolny (bias, w0)? Do czego w ogóle służy w0?
Czy można tanio naprawić problem z użyciem modułu w spadku gradientu?
Czym jest H(X) w kontekście klasyfikacji, na przykład entropia?
Jak porównywać współrzędne zmiennoprzecinkowe z uwzględnieniem cech typu float w różnych językach?
Jak zachowują się Precision i Recall przy nierównowadze klas? Przykład: 95 jednostek i 5 zer, model zawsze przewiduje 1.
Czym jest re-ranker w RAG? Jakie modele używają (cross-encoder, bge-reranker)?
Czym jest krzywa ROC?
Czym jest kryterium rozgałęzienia w drzewach?
Czym się interesujesz na zewnątrz?
Jak opisać architekturę modelu lasu losowego z dodanym modelem liniowym do ekstrapolacji?
Czym jest model językowy Unigram w tokenizacji (jak w SentencePiece)?