Nach der neuen Version des Modells ist die durchschnittliche Qualitätsbewertung gestiegen, aber die Redakteure sagen, dass die Antworten zu rechtlichen und finanziellen Themen deutlich schlechter geworden sind. Welche Visualisierung würden Sie zuerst machen, um zu entscheiden, ob die Veröffentlichung gestoppt werden soll?
Machine Learning / AI
Geben Sie ein Beispiel, bei dem die falsche Verwendung von BatchNorm im `eval()`-Modus zu Fehlern bei den Vorhersagen führte.
Praktische Aufgabe Welcher Artefaktensatz ermöglicht eine ehrliche Reproduktion des Vergleichs zweier LoRA-Läufe? - Nur die endgültige Qualitätstabelle. - Commit mit Code und Screenshot der endgültigen Metrik. - Code und Konfigurationsdatei des Experiments. - Code, Daten-Hash, Basismodell, LoRA-Konfiguration, Abhängigkeiten und Startbefehl. - Nur Link zum Git-Branch. - Code, LoRA-Parameter, Version des Basismodells und Abhängigkeiten.
Wie verwalten Sie in solchen Experimenten normalerweise Versionen von Daten und Modellen?
Gibt es derzeitige Vorstellungsgespräche bei Big-Tech-Unternehmen wie Yandex oder Alfa?
Praktische Aufgabe SQL-Abfrage mit 80 Millionen Nachrichten erzeugt Duplikate nach dem JOIN. Welche Aktion sollte zuerst gestartet werden? - Überprüfen Sie die Kardinalität des JOIN, die Schlüssel und den Ausführungsplan vor der Optimierung. - Erstellen Sie einen Index auf einem Verbindungsschlüssel. - Exportieren Sie das Ergebnis in CSV und entfernen Sie Duplikate in Python. - Fügen Sie immer DISTINCT zu allen Spalten hinzu. - Fügen Sie DISTINCT nach der Überprüfung des Ergebnisses auf der Stichprobe hinzu. - Überprüfen Sie die Verbindungsschlüssel und die Einzigartigkeit beider Tabellen.
Planen Sie, weiterhin auf den Philippinen zu bleiben oder in ein anderes Land umzuziehen?
Können Sie genauer erklären, was Sie an den Fragen "erdrückend" fanden und wie sich das auf Ihre Wahrnehmung des Vorstellungsgesprächs ausgewirkt hat?
Haben Sie Erfahrung in vollständig englischsprachigen Teams?
Wie würden Sie den quantitativen Einfluss der Emissionen auf die Modellmetriken, wie z.B. Genauigkeit oder F1-Score, einschätzen?
Haben Sie Erfahrung mit KI-Interviews?
Haben Sie Angebote in der Hand oder befinden sich in den letzten Phasen bei anderen Unternehmen?
Wie würden Sie die Indizes auf den Verbindungsschlüsseln optimieren, um Duplikate zu reduzieren und die Abfrage zu beschleunigen?
Stell dir vor, du arbeitest mit einem Modell in PyTorch und nach dem Umschalten in den Evaluierungsmodus eval() stellst du fest, dass die Metriken auf einem festen Testset von 10.000 Beispielen bei jedem Lauf variieren. Du fixierst den Anfangszustand der Zufallsgeneratoren für Reproduzierbarkeit: Wo könnte sonst die Quelle der Änderungen verborgen sein? Erkläre die Rolle von Dropout, BatchNorm und torch.no_grad() und nenne Metriken mit Schwellenwerten, anhand derer du die Stabilität der Ergebnisse überprüfst.
Bewerten Sie Ihr Englisch separat für Lesen/Schreiben und Sprechen nach den CEFR-Stufen.
Praktische Aufgabe Die KI schlägt vor, LoRA auf allen 2 Millionen unbereinigten Dialogen zu trainieren. Welche Antwort des Kandidaten ist am reifen? - Vertrauen in die KI: Ein großer Korpus wird Fehler ausgleichen. - Zuerst den Prompt ändern, ohne die Daten zu verändern. - LoRA auf den bereinigten Teil trainieren und mit dem Basismodell vergleichen. - Zufällige Stichprobe der Markierungen vor dem Training überprüfen. - Zuerst die Daten und die Qualität nach Themen in einem separaten Satz überprüfen, dann LoRA eingeschränkt trainieren. - Auf dem gesamten Korpus trainieren, aber den Rang von LoRA verringern.
Welches Formalisierungsformat ist für Sie am bequemsten: GPH, IP oder TК?
Wie würden Sie `EXPLAIN` genau verwenden, um Leistungsprobleme bei dieser Abfrage zu erkennen?
In der Dialogtabelle gibt es 80 Millionen Nachrichten, und die analytische Abfrage für den Bewertungsdatensatz dauert 25 Minuten und liefert manchmal doppelte Frage-Antwort-Paare zurück. Was würden Sie zuerst beheben und warum?
Zur Generierung von Fragen hat das große Sprachmodell Schwierigkeiten, den Stil bei seltenen Themen beizubehalten. Der KI-Assistent schlägt vor, sofort LoRA auf den gesamten historischen Korpus von 2 Millionen Dialogen anzuwenden, aber die Markierung ist teilweise verrauscht. In welchen Fällen würden Sie diesem Rat nicht vertrauen und was würden Sie zuerst wählen?