Wie bewertet man die Qualität des Retrievers? Woher bekommt man eine Sammlung von Dokumenten zur Bewertung der Metriken?
Machine Learning / AI
Was ist vLLM und wofür wird es verwendet?
Sie haben einen kleinen Datensatz mit Filmkritiken auf Russisch und deren binärer Tonalitätsmarkierung (Labels: 0 — negativ, 1 — positiv). Ihre Aufgabe ist es, in 15 Minuten eine vollständige Pipeline zum Trainieren eines einfachen Textklassifikationsmodells ohne Verwendung vortrainierter Encoder wie BERT zu implementieren und die Genauigkeit (accuracy) auf diesen Daten anzuzeigen. reviews = [ "Dieser Film ist einfach erstaunlich!", "Horrende Schauspieler und langweilige Handlung.", "Mir hat jeder Moment sehr gefallen!", "Der schlechteste Film, den ich je gesehen habe.", "Ausgezeichnete Regiearbeit und wunderbare Geschichte.", "Untragbar langweilig und vorhersehbar." ] labels = [1, 0, 1, 0, 1, 0]
Was ist der Unterschied zwischen Tensor Parallel Size und Data Parallel Size in vLLM?
Was ist RAG und welches grundlegende Problem löst es?
Welcher Parameter im Embedding-Modell bestimmt die maximale Anzahl an Tokens im Eingang? Was passiert, wenn mehr Tokens als das Limit eingegeben werden?
Wie beeinflusst eine Vergrößerung der Batch-Größe um das Vierfache die Lernrate und warum? Wie funktioniert das Backpropagation-Verfahren?
Erzähle mir von dir und deiner Erfahrung
Was ist ein Embedding-Modell und was ist ein Token?
Was ist die Quantisierung des Modells und was passiert mit den Gewichten bei ihrer Anwendung in vLLM?
Wie werden die Daten aus der Vektor-Datenbank anhand einer Benutzeranfrage abgerufen?
Was passiert, wenn man einem LLM einen Kontext von 120.000 Tokens bei einem Limit von 60.000 gibt?
Was ist LangGraph, wofür wird es verwendet, wie werden Verzweigungen und bedingte Übergänge implementiert? Worin unterscheiden sich Tools von Knoten?
Wie wurde die Informationssuche in der Vektordatenbank organisiert? Warum wurde Qdrant verwendet?