Πώς καθορίζουμε αν το μοντέλο embeddings λειτουργεί καλά; Ποιες μετρήσεις χρησιμοποιήθηκαν;
Machine Learning / AI
Μπορείς να εξηγήσεις τη διαφορά μεταξύ cross-encoder και bi-encoder;
Υπάρχει τρόπος να ελέγξετε ότι το παραγόμενο κείμενο δεν περιέχει πραγματικά λάθη σε σχέση με το αρχικό;
Πες μου για την ποσοτικοποίηση μοντέλων: τι είναι, γιατί χρειάζεται, ποια είδη υπάρχουν;
Πώς εξήχθησαν τα δεδομένα από αρχεία PDF για το σύστημα RAG;
Πώς να δοκιμάσετε μια υπηρεσία που υλοποιήθηκε σε FastAPI;
Πώς επιλέχθηκε η στρατηγική τμηματοποίησης (chunking) για το σύστημα RAG;
Μίλησέ μου για τις μετρήσεις απόδοσης της υπηρεσίας ML: καθυστέρηση, RPS, πώς οργανώθηκε αυτό στο έργο σου;
Πες μου για τις βάσεις δεδομένων διανυσμάτων, ποιες υπάρχουν, πώς διαφέρουν, γιατί επιλέξατε το pgvector;
Μίλησέ μου για τις παραμέτρους γεννήτριας LLM: θερμοκρασία, top-k, top-p και άλλες.
Πώς σχετίζονται το Recall και το Precision, μπορεί να αυξηθεί το ένα χωρίς να μειωθεί το άλλο; Δώστε παραδείγματα εργασιών.
Μίλησέ μου για την πιο δύσκολη εργασία ή δυσκολία σε ένα από τα έργα.
Πώς αξιολογείται η ποιότητα της περίληψης;
Πώς οργανώθηκαν τα δεδομένα για την περίληψη των διαλόγων και πώς πραγματοποιήθηκε η εκπαίδευση;
Ποια μέθοδος ποσοτικοποίησης (int8 ή float) θα μειώσει λιγότερο την ποιότητα του μοντέλου;
Πώς θα προσεγγίζατε την εργασία της περίληψης ενός διαλόγου πολλών ανθρώπων σε ένα συνέδριο (π.χ., 10 προγραμματιστές στο Slack);
Ποιο μοντέλο και προσέγγιση να επιλέξετε για την επεξεργασία ήχου από μια διάσκεψη (speech-to-text, διαχωρισμός διαλόγων);
Πες μου για το LoRA: τι είναι, ποιος είναι ο σκοπός του;
Πώς να εργαστείτε με ιδιωτικά δεδομένα κατά την τοπική ανάπτυξη του συστήματος;
Γιατί επιλέξατε την υβριδική αναζήτηση BM25 + embeddings αντί μόνο της απόστασης συνημίτονου;