Cos'è la didascalia delle immagini e quali metriche la valutano (CIDEr)?
Machine Learning / AI
Quali sono le tendenze architettoniche degli attuali modelli di linguaggio di grandi dimensioni (LLM) solo decodificatori (LLaMA, Mistral, Qwen)?
Cos'è lo stato di credenza e come viene aggiornato?
Come gestire caratteri geroglifici rari ed emoji nel tokenizer?
Quali problemi ha RLHF nella pratica (reward hacking, mode collapse)?
Cos'è il negative sampling nell'addestramento di word2vec e a cosa serve?
Quali sono le caratteristiche di sicurezza nella gestione dei robot con apprendimento automatico?
Cos'è il fine-tuning supervisionato (SFT)? Quali dati sono necessari?
Cos'è Prophet e quali sono i suoi punti di forza/debolezza?
Perché la similarità coseno è spesso preferita rispetto alla distanza euclidea per la ricerca semantica?
Quali sono le tendenze moderne nell'addestramento su cluster misti GPU+CPU+TPU?
Parlaci di bag-of-words e delle sue limitazioni.
Quali sono le caratteristiche dell'apprendimento attivo in CV?
In cosa si differenzia la validazione incrociata delle serie temporali dalla normale K-Fold?
Cos'è l'aumento CopyPaste?