Exercițiu practic
AI a generat un cod pentru a decide despre lansarea unui nou LLM. Realizează o revizuire: modifică-l astfel încât editorul să poată compara calitatea versiunilor pe segmente tematice, să vadă dispersia evaluărilor și să observe riscul de deteriorare pe un grup mic de date.
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
summary = scores.groupby('model_version')['score'].mean()
plt.bar(summary.index, summary.values)
plt.title('Calitatea modelelor')
plt.ylabel('Scor mediu')
plt.show()
print('Cea mai bună versiune:', summary.idxmax())