Praktiskais uzdevums
Mākslīgais intelekts ir ģenerējis kodu lēmumam par jauna LLM izlaišanu. Veiciet pārskatīšanu: mainiet to tā, lai redaktors varētu salīdzināt versiju kvalitāti pēc tematiskiem segmentiem, redzēt novērtējumu izkliedi un pamanīt risku pasliktināšanai mazā datu grupā.
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
summary = scores.groupby('model_version')['score'].mean()
plt.bar(summary.index, summary.values)
plt.title('Modeļu kvalitāte')
plt.ylabel('Vidējā novērtējuma')
plt.show()
print('Labākā versija:', summary.idxmax())
---
import matplotlib.pyplot as plt
import pandas as pd
scores = pd.read_csv('model_scores.csv')
stats = (
scores.groupby(["topic", "model_version"])["score"]
.agg(["mean", "std", "count"])
.reset_index()
)
print(stats)
for topic, group in scores.groupby("topic"):
group.boxplot(column="score", by="model_version")
plt.title(f"Tēma: {topic}")
plt.suptitle("")
plt.ylabel("Novērtējums")
plt.show()
small_groups = stats[stats["count"] < 30]
print("Mazās grupas - secinājumi nav uzticami:")
print(small_groups)