Sobes.tech
Senior

Tarea práctica AI generó un código para la decisión sobre el lanzamiento de un nuevo LLM. Realiza una revisión: modifícalo para que el editor pueda comparar la calidad de las versiones por segmentos temáticos, ver la dispersión de las evaluaciones y notar el riesgo de deterioro en un pequeño grupo de datos. import matplotlib.pyplot as plt import pandas as pd scores = pd.read_csv('model_scores.csv') summary = scores.groupby('model_version')['score'].mean() plt.bar(summary.index, summary.values) plt.title('Calidad de los modelos') plt.ylabel('Puntuación media') plt.show() print('Mejor versión:', summary.idxmax())