Tarefa prática
A IA gerou um código para decidir sobre o lançamento de um novo LLM. Faça uma revisão: modifique-o para que o editor possa comparar a qualidade das versões por segmentos temáticos, ver a dispersão das avaliações e notar o risco de deterioração em um pequeno grupo de dados.
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
summary = scores.groupby('model_version')['score'].mean()
plt.bar(summary.index, summary.values)
plt.title('Qualidade dos modelos')
plt.ylabel('Avaliação média')
plt.show()
print('Melhor versão:', summary.idxmax())