Cos'è un token OOV e come si occupa di esso la subword-tokenizzazione?
Machine Learning / AI
Qual è la differenza tra stemming e lemmatizzazione? In quali compiti usare l'uno o l'altro?
Come profilare l'inferenza LLM sulla GPU (nsight, torch profiler)?
Quali sono i rischi di AutoML dal punto di vista dell'interpretabilità?
Cosa sono le immagini multispettrali e iperspettrali?
Cosa sono i multi-armed bandits e dove usarli al posto dei test A/B?
Venerdì, mancano 2,5 ore alla fine della giornata lavorativa. Arriva un cliente e dice che lunedì alle 9:30 c'è un incontro e bisogna finire un compito che richiede 5-6 ore. Cosa farai?
Cos'è la redazione e la tokenizzazione di PII nei set di dati?
Domande del candidato sul formato di lavoro e sul team.
Cos'è MIG (Multi-Instance GPU) su A100/H100?
Cos'è Medusa e le teste di previsione multi-token?
Cos'è un token e quali sono le differenze tra tokenizzazione a livello di carattere, parola e sottoparola?
Cos'è l'approssimazione di campo medio?
I dati erano memorizzati sotto forma di tabella piatta? Hai sviluppato tu stesso le funzionalità o qualcun altro le ha fatte per te?
Cos'è un confounder e come considerarlo?
Quali problemi si incontrano nella previsione di serie instabili (cold start dei prodotti)?
Cos'è la segmentazione degli oggetti video e il tracciamento delle maschere (XMem, SAM2)?
Qual è la differenza tra retrieval sparso (BM25) e dense?
Cos'è un attacco mirato vs un attacco non mirato?
Cosa sono i meta-apprendenti (S-learner, T-learner, X-learner, R-learner)?