Machine Learning / AI
Wie erhält man eine formalisierte, strukturierte Antwort, zum Beispiel bei Verwendung von strukturiertem Output?
An welchem Projekt haben Sie an der Bereitstellung von Diensten und der Entwicklung von FastAPI-Diensten gearbeitet: Haben Sie das selbst umgesetzt oder nur gewartet und überwacht?
Wie man einen Agenten entwirft, der auf Basis von Transaktionsdaten auf Benutzeranfragen antwortet: Welche Technologie-Stack und Architektur sind erforderlich, und ist der Einsatz von Multi-Agenten sinnvoll?
Machen das alles verschiedene Agenten oder verschiedene Werkzeuge eines einzelnen Agenten?
Welche weiteren Optimierungsmethoden können verwendet werden, um die Inferenz zu beschleunigen oder zumindest das Modell in 12 GB VRAM auf einer RTX 3090 unterzubringen?
Worin unterscheidet sich ChatGPT im Allgemeinen von einem Assistenten innerhalb eines Unternehmens (Chatbot vs Assistent)?
In welche Richtung möchten Sie sich in Zukunft entwickeln, welche beruflichen Richtungen heben Sie für sich hervor?
Wie verläuft im Allgemeinen der Weg einer ML/LLM-Anwendung vom Dockerfile und Quellcode bis zum bereitgestellten Service und Nutzerverkehr in Kubernetes?
Wie stellen Sie die Herkunft der Ergebnisse des Experiments sicher, um genau zu verstehen, woher die Metriken stammen?
Welches Embedding-Modell für RAG wählen?
Wie kann man verhindern, dass ein Mock-System bei einer geänderten Anfrage des Agents irrelevante historische Daten liefert oder keine Daten für die Anfrage findet?
Was kann man tun, wenn sich der Kontext des Agents bei längerer Arbeit allmählich füllt?
Wie man in der Praxis ein Modell in einem bestimmten Feld dazu bringt, nur Werte aus einer kurzen Liste von String-ID's und keine anderen Symbole zu generieren?
Wie wirkt sich das Wachstum des Dialogs und des Kontexts auf die Geschwindigkeit der Antwortverarbeitung aus?
Was kann getan werden, damit das Modell nicht antwortet, wenn im Kontext keine Informationen zur Beantwortung der Frage vorhanden sind?
Was ist spekulatives Decoding und wie funktioniert es?
Wie misst man, ob ein Embedding-Modell und eine Retrieval-Funktion richtig funktionieren?
Wie übergibt man auf Code-Ebene ein Modellschema für strukturierte Ausgabe?