Praktiskais uzdevums
Mākslīgais intelekts ir ģenerējis kodu, lai pieņemtu lēmumu par jauna LLM izlaišanu. Veiciet pārskatīšanu: mainiet to tā, lai redaktors varētu salīdzināt versiju kvalitāti pēc tematiskiem segmentiem, redzēt novērtējumu izkliedi un pamanīt risku pasliktināšanās mazā datu grupā.
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
summary = scores.groupby('model_version')['score'].mean()
plt.bar(summary.index, summary.values)
plt.title('Modeļu kvalitāte')
plt.ylabel('Vidējā vērtējuma')
plt.show()
print('Labākā versija:', summary.idxmax())