Sobes.tech

Machine Learning / AI

Beeinflusst die unterschiedliche Länge der Sätze (15 Wörter vs 5 Wörter) die Möglichkeit, ihre Ähnlichkeit zu vergleichen?

Middle+
Сбербанк
24

Was wandelt die Geschwindigkeit des Modells in eine Klassenmarkierung um?

Middle
Япоки
24

Gab es weitere technische Schwierigkeiten mit den Halluzinationen?

Senior
Фарпост ИТ
24

Berechnen Sie die Gesamtsumme des Umsatzes (revenue) für jeden Benutzer Für jeden Benutzer finden Sie das erste und letzte Kaufdatum Fügen Sie dem DataFrame eine neue Spalte prev_revenue hinzu, die den Umsatz des vorherigen Kaufs desselben Benutzers enthält (Verschiebung innerhalb der Gruppe). Wenn kein vorheriger Kauf vorhanden ist, NaN setzen

Middle
НорникельНорникель
24

Was ist Überanpassung und wie kann man sie vermeiden?

Middle
AstonAston
24

Erzählen Sie mir von CI/CD

Senior
МВидео/эльдорадо
24

Welche Hyperparameter von LoRA kennst du?

Middle+
СОГАЗ
24

Geben Sie die Ausführungsreihenfolge der Operatoren in dieser SQL-Abfrage an

Senior
Яндекс
24

Was ist strukturierte Ausgabe und wie wird sie in LLM angewendet?

Middle+
СБЕРСБЕР
24

Erzählen Sie mir von sich und Ihrer Berufserfahrung

Senior
Яндекс
24

Wo wird das Prompt im Überwachungssystem gespeichert und wie wird es angezeigt?

Middle+
СБЕРСБЕР
24

Wie würden Sie dasselbe Problem der Suche nach dem letzten Klick ohne JOIN lösen?

Middle
Ozon FreshOzon Fresh
24

Warum kann LoRA auch bei einer kleinen Anzahl von Parametern überanpassen? Beeinflusst die Wahl des Rangs das Überanpassen?

Middle+
AiUP
24

Praktische Aufgabe KI hat einen Code für die Entscheidung über die Einführung eines neuen LLM generiert. Überprüfe ihn: Ändere ihn so, dass der Editor die Qualität der Versionen nach thematischen Segmenten vergleichen, die Streuung der Bewertungen sehen und das Risiko einer Verschlechterung bei einer kleinen Datenmenge bemerken kann. import matplotlib.pyplot as plt import pandas as pd scores = pd.read_csv('model_scores.csv') summary = scores.groupby('model_version')['score'].mean() plt.bar(summary.index, summary.values) plt.title('Modellqualität') plt.ylabel('Durchschnittliche Bewertung') plt.show() print('Beste Version:', summary.idxmax()) --- import matplotlib.pyplot as plt import pandas as pd scores = pd.read_csv('model_scores.csv') stats = ( scores.groupby(["topic", "model_version"])["score"] .agg(["mean", "std", "count"]) .reset_index() ) print(stats) for topic, group in scores.groupby("topic"): group.boxplot(column="score", by="model_version") plt.title(f"Thema: {topic}") plt.suptitle("") plt.ylabel("Bewertung") plt.show() small_groups = stats[stats["count"] < 30] print("Kleine Gruppen - Schlussfolgerungen sind nicht zuverlässig:") print(small_groups)

Senior
ylab
23

Worauf stützen Sie sich bei der Bestimmung der Spanne?

Senior
ТочкаТочка
23

Nennen Sie die klassischen Methoden zur Erzeugung von Wort-Embeddings (Word2Vec, FastText, TF-IDF, N-Gramme usw.).

Middle+
AvitoAvito
23

Welche Wünsche oder Einschränkungen haben Sie bezüglich Projekte und Fachgebiete?

Senior
ylab
23

Kannst du den Unterschied zwischen Recall und MRR einfach erklären?

Senior
iviivi
23

Warum hast du dich nach eineinhalb Jahren entschieden, 1C:Rarus zu verlassen?

Senior
НООСФЕРА
23

Was erwägst du, welche Profilstellen wären für dich interessant?

Senior
Яндекс
23
/177