Zadanie praktyczne
AI wygenerowało kod do podjęcia decyzji o wydaniu nowego LLM. Przeprowadź przegląd: zmodyfikuj go tak, aby edytor mógł porównać jakość wersji według segmentów tematycznych, zobaczyć rozrzut ocen i zauważyć ryzyko pogorszenia na małej grupie danych.
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
summary = scores.groupby('model_version')['score'].mean()
plt.bar(summary.index, summary.values)
plt.title('Jakość modeli')
plt.ylabel('Średnia ocena')
plt.show()
print('Najlepsza wersja:', summary.idxmax())