Cos'è il prompt tuning e dove viene applicato?
Machine Learning / AI
Cosa sono gli embedding quantizzati e come vengono applicati nella ricerca di prodotti?
Spiega la formula dell'attenzione a prodotto scalare scalata. Perché dividere per sqrt(d_k)?
Qual è la differenza tra modelli di linguaggio autoregressivi e mascherati?
Cos'è il fine-tuning supervisionato (SFT)? Quali dati sono necessari?
Quali sono le metriche di qualità della generazione in RAG (fedeltà, rilevanza della risposta, precisione/ricordo del contesto)?
Cosa sono i Modelli di Diffusione Latente (Diffusione Stabile)?
Cos'è il tradeoff tra esplorazione e sfruttamento e come viene implementato (campionamento di Thompson, epsilon-greedy)?
Cosa regola il parametro temperature?
Cos'è la ricerca a fascio e perché viene usata raramente per la generazione aperta?
Cos'è BLIP-2 e qual è il ruolo di Q-Former?
Progetta un sistema di moderazione dei contenuti UGC (testo + immagini).
Cos'è un refiner in SDXL e qual è il suo ruolo?
Cos'è la quantizzazione del prodotto (PQ) e quali sono le sue perdite di qualità?