Sobes.tech

Machine Learning / AI

Nach der neuen Version des Modells ist die durchschnittliche Qualitätsbewertung gestiegen, aber die Redakteure sagen, dass die Antworten zu rechtlichen und finanziellen Themen deutlich schlechter geworden sind. Welche Visualisierung würden Sie zuerst machen, um zu entscheiden, ob die Veröffentlichung gestoppt werden soll?

Senior
160

Geben Sie ein Beispiel, bei dem die falsche Verwendung von BatchNorm im `eval()`-Modus zu Fehlern bei den Vorhersagen führte.

Senior
160

Praktische Aufgabe Welcher Artefaktensatz ermöglicht eine ehrliche Reproduktion des Vergleichs zweier LoRA-Läufe? - Nur die endgültige Qualitätstabelle. - Commit mit Code und Screenshot der endgültigen Metrik. - Code und Konfigurationsdatei des Experiments. - Code, Daten-Hash, Basismodell, LoRA-Konfiguration, Abhängigkeiten und Startbefehl. - Nur Link zum Git-Branch. - Code, LoRA-Parameter, Version des Basismodells und Abhängigkeiten.

Senior
159

Wie verwalten Sie in solchen Experimenten normalerweise Versionen von Daten und Modellen?

Senior
158

Gibt es derzeitige Vorstellungsgespräche bei Big-Tech-Unternehmen wie Yandex oder Alfa?

Senior
158

Praktische Aufgabe SQL-Abfrage mit 80 Millionen Nachrichten erzeugt Duplikate nach dem JOIN. Welche Aktion sollte zuerst gestartet werden? - Überprüfen Sie die Kardinalität des JOIN, die Schlüssel und den Ausführungsplan vor der Optimierung. - Erstellen Sie einen Index auf einem Verbindungsschlüssel. - Exportieren Sie das Ergebnis in CSV und entfernen Sie Duplikate in Python. - Fügen Sie immer DISTINCT zu allen Spalten hinzu. - Fügen Sie DISTINCT nach der Überprüfung des Ergebnisses auf der Stichprobe hinzu. - Überprüfen Sie die Verbindungsschlüssel und die Einzigartigkeit beider Tabellen.

Senior
157

Planen Sie, weiterhin auf den Philippinen zu bleiben oder in ein anderes Land umzuziehen?

Senior
155

Können Sie genauer erklären, was Sie an den Fragen "erdrückend" fanden und wie sich das auf Ihre Wahrnehmung des Vorstellungsgesprächs ausgewirkt hat?

Senior
154

Haben Sie Erfahrung in vollständig englischsprachigen Teams?

Senior
154

Wie würden Sie den quantitativen Einfluss der Emissionen auf die Modellmetriken, wie z.B. Genauigkeit oder F1-Score, einschätzen?

Senior
150

Haben Sie Erfahrung mit KI-Interviews?

Senior
150

Haben Sie Angebote in der Hand oder befinden sich in den letzten Phasen bei anderen Unternehmen?

Senior
149

Wie würden Sie die Indizes auf den Verbindungsschlüsseln optimieren, um Duplikate zu reduzieren und die Abfrage zu beschleunigen?

Senior
145

Stell dir vor, du arbeitest mit einem Modell in PyTorch und nach dem Umschalten in den Evaluierungsmodus eval() stellst du fest, dass die Metriken auf einem festen Testset von 10.000 Beispielen bei jedem Lauf variieren. Du fixierst den Anfangszustand der Zufallsgeneratoren für Reproduzierbarkeit: Wo könnte sonst die Quelle der Änderungen verborgen sein? Erkläre die Rolle von Dropout, BatchNorm und torch.no_grad() und nenne Metriken mit Schwellenwerten, anhand derer du die Stabilität der Ergebnisse überprüfst.

Senior
141

Bewerten Sie Ihr Englisch separat für Lesen/Schreiben und Sprechen nach den CEFR-Stufen.

Senior
140

Praktische Aufgabe Die KI schlägt vor, LoRA auf allen 2 Millionen unbereinigten Dialogen zu trainieren. Welche Antwort des Kandidaten ist am reifen? - Vertrauen in die KI: Ein großer Korpus wird Fehler ausgleichen. - Zuerst den Prompt ändern, ohne die Daten zu verändern. - LoRA auf den bereinigten Teil trainieren und mit dem Basismodell vergleichen. - Zufällige Stichprobe der Markierungen vor dem Training überprüfen. - Zuerst die Daten und die Qualität nach Themen in einem separaten Satz überprüfen, dann LoRA eingeschränkt trainieren. - Auf dem gesamten Korpus trainieren, aber den Rang von LoRA verringern.

Senior
140

Welches Formalisierungsformat ist für Sie am bequemsten: GPH, IP oder TК?

Senior
139

Wie würden Sie `EXPLAIN` genau verwenden, um Leistungsprobleme bei dieser Abfrage zu erkennen?

Senior
138

In der Dialogtabelle gibt es 80 Millionen Nachrichten, und die analytische Abfrage für den Bewertungsdatensatz dauert 25 Minuten und liefert manchmal doppelte Frage-Antwort-Paare zurück. Was würden Sie zuerst beheben und warum?

Senior
135

Zur Generierung von Fragen hat das große Sprachmodell Schwierigkeiten, den Stil bei seltenen Themen beizubehalten. Der KI-Assistent schlägt vor, sofort LoRA auf den gesamten historischen Korpus von 2 Millionen Dialogen anzuwenden, aber die Markierung ist teilweise verrauscht. In welchen Fällen würden Sie diesem Rat nicht vertrauen und was würden Sie zuerst wählen?

Senior
135
/2