Практическо задание
Изкуственият интелект генерира код за вземане на решение относно пускането на нов LLM. Направете преглед: модифицирайте го така, че редакторът да може да сравнява качеството на версиите по тематични сегменти, да вижда разпръснатостта на оценките и да забележи риска от влошаване на малка група данни.
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
summary = scores.groupby('model_version')['score'].mean()
plt.bar(summary.index, summary.values)
plt.title('Качество на моделите')
plt.ylabel('Средна оценка')
plt.show()
print('Най-добра версия:', summary.idxmax())