Sobes.tech

Machine Learning / AI

Wie bewertet man die Qualität des Retrievers? Woher bekommt man eine Sammlung von Dokumenten zur Bewertung der Metriken?

362

Sie haben einen kleinen Datensatz mit Filmkritiken auf Russisch und deren binärer Tonalitätsmarkierung (Labels: 0 — negativ, 1 — positiv). Ihre Aufgabe ist es, in 15 Minuten eine vollständige Pipeline zum Trainieren eines einfachen Textklassifikationsmodells ohne Verwendung vortrainierter Encoder wie BERT zu implementieren und die Genauigkeit (accuracy) auf diesen Daten anzuzeigen. reviews = [ "Dieser Film ist einfach erstaunlich!", "Horrende Schauspieler und langweilige Handlung.", "Mir hat jeder Moment sehr gefallen!", "Der schlechteste Film, den ich je gesehen habe.", "Ausgezeichnete Regiearbeit und wunderbare Geschichte.", "Untragbar langweilig und vorhersehbar." ] labels = [1, 0, 1, 0, 1, 0]

183

Was ist der Unterschied zwischen Tensor Parallel Size und Data Parallel Size in vLLM?

183

Welcher Parameter im Embedding-Modell bestimmt die maximale Anzahl an Tokens im Eingang? Was passiert, wenn mehr Tokens als das Limit eingegeben werden?

166

Wie beeinflusst eine Vergrößerung der Batch-Größe um das Vierfache die Lernrate und warum? Wie funktioniert das Backpropagation-Verfahren?

163

Was ist die Quantisierung des Modells und was passiert mit den Gewichten bei ihrer Anwendung in vLLM?

153

Wie werden die Daten aus der Vektor-Datenbank anhand einer Benutzeranfrage abgerufen?

151

Was passiert, wenn man einem LLM einen Kontext von 120.000 Tokens bei einem Limit von 60.000 gibt?

149

Was ist LangGraph, wofür wird es verwendet, wie werden Verzweigungen und bedingte Übergänge implementiert? Worin unterscheiden sich Tools von Knoten?

140

Wie wurde die Informationssuche in der Vektordatenbank organisiert? Warum wurde Qdrant verwendet?

139