Machine Learning / AI
Ποια λειτουργία απώλειας χρησιμοποιείται στην γραμμική παλινδρόμηση;
Πώς επηρεάζει η ποσότητα δεδομένων την επιλογή του δείκτη για αναζήτηση;
Με ποιο εργαλείο έγινε ο δομημένος διαχωρισμός των εγγράφων;
Πώς ελέγχετε συνήθως την ποιότητα και τη σχετικότητα των δεδομένων πριν από την εκπαίδευση του LoRA;
Πώς να επιλέξετε το μέγεθος του διανύσματος ενσωμάτωσης;
Ποιες συγκεκριμένες υλοποιήσεις boosting γνωρίζετε ή με ποιες έχετε εργαστεί;
Έχεις τώρα προσφορές/προ-προσφορές στα χέρια σου; Πόσο ενεργά εξετάζεις τις προτάσεις;
Με τι ασχολούνταν;
Υλοποίηση αλγορίθμου σύνδεσης ακολουθιών, για παράδειγμα, hash join;
Ποια μεθόδους μοντελοποίησης χρησιμοποιούνται για την δυαδική ταξινόμηση;
Τι είναι το AlphaFold και ποιο είναι το αρχή του;
Ποια είναι τα χαρακτηριστικά της συλλογής ετικετών (crowdsourcing, ενεργή μάθηση);
Πώς χειρίζεστε σπάνια ιερογλυφικά σύμβολα και emoji στον tokenizer;
Πώς υπολογίζεται η συσχετιστική μήτρα;
Ποιο μοντέλο embedding να επιλέξω για το RAG;
Τι είναι η ποινή επανάληψης και η ποινή συχνότητας/παρουσίας;
Ποιες αξιολογήσεις LLM γνωρίζετε (MMLU, BBH, GSM8K, HumanEval);
Πώς να αντιμετωπίσετε την ανισορροπία των τάξεων;
Πώς φαίνεται αρχιτεκτονικά η εκπαίδευση του Word2Vec; Πώς προβλέπει το μοντέλο τη λείπουσα λέξη από το πλαίσιο;
Αναφέρετε για την κανονικοποίηση στους κλασικούς αλγόριθμους ML: L1 και L2. Ποια είναι τα χαρακτηριστικά και οι διαφορές τους;