Sobes.tech

Machine Learning / AI

Cum se evaluează calitatea retriever-ului? De unde se obține o colecție de documente pentru evaluarea metricilor?

369

Ai un set mic de date cu recenzii de filme în rusă și eticheta lor binară de tonalitate (etichete: 0 — negativ, 1 — pozitiv). Sarcina ta este să implementezi un pipeline complet în 15 minute pentru a antrena un model simplu de clasificare a textului fără a folosi encodere pre-antrenate precum BERT, și să afișezi acuratețea (accuracy) pe aceste date. reviews = [ "Acest film este pur și simplu incredibil!", "Joc de actorii oribil și poveste plictisitoare.", "Mi-a plăcut fiecare moment!", "Cel mai rău film pe care l-am văzut.", "Lucru excelent de regie și poveste minunată.", "Insuportabil de plictisitor și previzibil." ] labels = [1, 0, 1, 0, 1, 0]

183

Care este diferența dintre Tensor Parallel Size și Data Parallel Size în vLLM?

183

Ce parametru din modelul de embedding determină numărul maxim de tokens la intrare? Ce se întâmplă dacă se introduc mai mulți tokens decât limita?

168

Cum influențează mărirea batch-ului de 4 ori rata de învățare și de ce? Cum funcționează propagarea înapoi?

163

Cum sunt extrase datele din baza vectorială pe baza unei solicitări a utilizatorului?

153

Ce este cuantificarea modelului și ce se întâmplă cu greutățile atunci când este aplicată în vLLM?

153

Ce se întâmplă dacă oferiți un context de 120.000 de tokenuri într-un LLM cu o limită de 60.000?

151

Cum a fost organizată căutarea de informații în baza vectorială? De ce s-a folosit Qdrant?

141

Ce este LangGraph, pentru ce se folosește, cum sunt implementate ramificațiile și tranzițiile condiționale? Cu ce diferă uneltele de noduri?

140