Machine Learning / AI
Qual è la differenza tra NaN e None in Python?
Quali sono gli approcci per una scalabilità responsabile degli LLM?
Cos'è NSP (previsione della frase successiva) e perché RoBERTa l'ha abbandonata?
Quanto sarà accurata l'anonimizzazione dei dati?
Qual è la differenza tra le metriche NDCG e Accuracy? Quale è più importante per il feed di notizie?
Qual è la differenza tra threading e multiprocessing in Python e per quali compiti vengono utilizzati?
Come gestire una lista vuota in ingresso?
Qual è l'interpretazione probabilistica dell'ROC-AUC?
Cosa sono gli errori di primo e secondo tipo?
Cos'è un feature store e quali compiti risolve (Feast, Tecton)?
Hai mai affrontato uno spostamento dei dati?
Come capire quando fermare la selezione delle caratteristiche?
Cosa fare se il modello non entra nella GPU durante il fine-tuning?
Quali motivi possono portare a valori diversi della media giornaliera di visite a un servizio web da parte di diversi analisti?
Come normalizzare i valori numerici e minimizzare l'impatto dei valori anomali?
Cosa sono DVC e Git LFS per il versioning dei dati?
Cos'è l'autocorrelazione e l'autocorrelazione parziale (ACF, PACF)?
Cos'è GIL in Python, a cosa serve e come funziona?
Cos'è la quantizzazione dei modelli?
Quali ottimizzazioni specifiche per ARM (NEON)?