Πώς συμπεριφέρονται το Precision και το Recall σε περίπτωση ανισορροπίας των κλάσεων; Παράδειγμα: 95 μονάδες και 5 μηδενικά, το μοντέλο πάντα προβλέπει 1.
Machine Learning / AI
Αν το AUC ενός νέου μοντέλου είναι 0,82 σε σύγκριση με 0,80 στο προηγούμενο, μπορούμε να πούμε με βεβαιότητα ότι το νέο είναι καλύτερο; Πώς ελέγχεται η στατιστική σημαντικότητα;
Ποια στατιστικά τεστ πρέπει να χρησιμοποιηθούν για την αξιολόγηση της σημαντικότητας των διαφορών μεταξύ των ομάδων και πώς διαφέρουν;
Ποια προβλήματα υπάρχουν στην πρακτική RLHF (reward hacking, mode collapse);
Τι είναι το μοτίβο ReAct (Reason + Act);
Τι είναι το MT-Bench και πώς υπολογίζεται η βαθμολογία;
Υπάρχουν ερωτήσεις σχετικά με το προϊόν και τις εργασίες που επιλύει η εταιρεία;
Αν ο worker είναι συγχρονικός, θα έχει batching;
Γιατί ένα σύνολο από πολλά δέντρα είναι καλύτερο από ένα μόνο δέντρο;
Πώς έγινε η περαιτέρω εκπαίδευση του embedder: με LoRA ή με πλήρη εκπαίδευση;
Ποια είναι η πολυπλοκότητα σε μνήμη και χρόνο της αυτοπροσοχής;
Πώς υλοποιείται η δρομολόγηση αιτημάτων μεταξύ σεναρίων — σε ποια μορφή δίνει την απάντηση το LLM και πώς επιλέγεται το σενάριο βάσει αυτής;
Τι είναι η λειτουργία πλεονεκτήματος και γιατί μειώνει τη διακύμανση;
Συγκρίθηκε ολόκληρη η συνομιλία ή μόνο κάποια μέρη της;
Ποια μοντέλα χρησιμοποιήσατε για την πρόβλεψη της ζήτησης;
Τι είναι το μοντέλο γλώσσας Unigram στην τοκενίωση (όπως στο SentencePiece);
Πείτε μας για την αρχιτεκτονική του U-Net και γιατί υπάρχουν οι skip connections.
Ο συντελεστής συσχέτισης είναι ίσος με 0. Μπορούμε να πούμε ότι τα δείγματα είναι ανεξάρτητα; Γιατί;
Τι είναι ο re-ranker στο RAG; Ποια μοντέλα χρησιμοποιούν (cross-encoder, bge-reranker);