Cum se evaluează calitatea retriever-ului? De unde se obține o colecție de documente pentru evaluarea metricilor?
Machine Learning / AI
Ce este vLLM și pentru ce este utilizat?
Ai un set mic de date cu recenzii de filme în rusă și eticheta lor binară de tonalitate (etichete: 0 — negativ, 1 — pozitiv). Sarcina ta este să implementezi un pipeline complet în 15 minute pentru a antrena un model simplu de clasificare a textului fără a folosi encodere pre-antrenate precum BERT, și să afișezi acuratețea (accuracy) pe aceste date. reviews = [ "Acest film este pur și simplu incredibil!", "Joc de actorii oribil și poveste plictisitoare.", "Mi-a plăcut fiecare moment!", "Cel mai rău film pe care l-am văzut.", "Lucru excelent de regie și poveste minunată.", "Insuportabil de plictisitor și previzibil." ] labels = [1, 0, 1, 0, 1, 0]
Care este diferența dintre Tensor Parallel Size și Data Parallel Size în vLLM?
Ce este RAG și ce problemă fundamentală rezolvă?
Ce parametru din modelul de embedding determină numărul maxim de tokens la intrare? Ce se întâmplă dacă se introduc mai mulți tokens decât limita?
Cum influențează mărirea batch-ului de 4 ori rata de învățare și de ce? Cum funcționează propagarea înapoi?
Spune-mi despre tine și experiența ta
Ce este un model de embedding și ce este un token?
Cum sunt extrase datele din baza vectorială pe baza unei solicitări a utilizatorului?
Ce este cuantificarea modelului și ce se întâmplă cu greutățile atunci când este aplicată în vLLM?
Ce se întâmplă dacă oferiți un context de 120.000 de tokenuri într-un LLM cu o limită de 60.000?
Cum a fost organizată căutarea de informații în baza vectorială? De ce s-a folosit Qdrant?
Ce este LangGraph, pentru ce se folosește, cum sunt implementate ramificațiile și tranzițiile condiționale? Cu ce diferă uneltele de noduri?