Machine Learning / AI
Parlami di LoRA: cos'è, come viene addestrato e come funziona nell'inferenza?
Come ottenere una risposta formalizzata e strutturata, ad esempio utilizzando l'output strutturato?
Per generare domande, il grande modello linguistico fatica a mantenere lo stile su argomenti rari. L'assistente AI propone di avviare subito LoRA sull'intero corpus storico di 2 milioni di dialoghi, ma l'annotazione è parzialmente rumorosa. In quali casi non si fiderebbe di questo consiglio e cosa sceglierebbe per primo?
Parli del progetto di clustering delle richieste con etichettatura per importanza commerciale.
Se il worker è sincrono, avrà batching?
Ci sono stati corsi sui modelli di ottimizzazione?
Quali fonti di dati per ML hai integrato (DWH, Kafka, S3)?
Cos'è l'equità intersezionale?
Quali sono gli svantaggi dell'approccio multi-agente?
Quali librerie vengono utilizzate per ottimizzare LLM?
Esercizio pratico Il punteggio medio del nuovo LLM è aumentato, ma gli editori si lamentano delle risposte finanziarie. Quale grafico supporterà meglio la decisione di rilascio? Un indicatore principale del punteggio medio. Colonne con il punteggio medio di tutti gli argomenti. Boxplot per argomenti e versioni del modello. Tabella delle valutazioni medie per argomento. Nuvola di parole delle nuove risposte. Distribuzioni delle valutazioni per versioni e argomenti con la dimensione di ogni gruppo.
Come hai implementato e distribuito il servizio per l'elaborazione delle pull request?
Perché hai riconosciuto i documenti come immagini invece di creare un parser?
Come vengono risolte la collisioni in un set? Quali metodi di risoluzione delle collisioni esistono?
Quale ranker è stato scelto per il reranking?
Come ti valuti?
Preferiresti dedicare il 100% del tuo tempo a scrivere codice o preferisci un'altra proporzione?
Hai lavorato con Docker, MLflow, Airflow?
Cosa sono le reti neurali bayesiane e come calcolare il posterior?
Qual è la differenza tra None in Python, NaN in NumPy e NA in Pandas?