Sobes.tech

Machine Learning / AI

Come valutare la qualità del retriever? Da dove ottenere una collezione di documenti per valutare le metriche?

362

Hai un piccolo set di dati con recensioni di film in russo e la loro etichetta binaria di tonalità (etichette: 0 — negativo, 1 — positivo). Il tuo compito è implementare un pipeline completo in 15 minuti per addestrare un modello semplice di classificazione del testo senza usare encoder pre-addestrati come BERT, e mostrare la precisione (accuracy) su questi dati. reviews = [ "Questo film è semplicemente incredibile!", "Gioco degli attori orribile e trama noiosa.", "Mi è piaciuto ogni momento!", "Il film più brutto che abbia mai visto.", "Ottimo lavoro di regia e storia meravigliosa.", "Insoportabilmente noioso e prevedibile." ] labels = [1, 0, 1, 0, 1, 0]

183

Quale parametro nel modello di embedding determina il numero massimo di token in ingresso? Cosa succede se si inseriscono più token del limite?

166

Come influisce un aumento di 4 volte della dimensione del batch sul tasso di apprendimento e perché? Come funziona la retropropagazione?

163

Cos'è la quantizzazione del modello e cosa succede ai pesi quando viene applicata in vLLM?

153

Cosa succede se si fornisce un contesto di 120.000 token in un LLM con un limite di 60.000?

151

Come vengono estratti i dati dal database vettoriale tramite una richiesta dell'utente?

151

Cos'è LangGraph, a cosa serve, come vengono implementati i rami e i passaggi condizionali? In cosa differiscono gli strumenti dai nodi?

140

Come è stata organizzata la ricerca di informazioni nel database vettoriale? Perché si è usato Qdrant?

139