Kako ste pratili ceo multiagentni sistem: na kojim fazama se javljaju greške, latencija itd.?
Machine Learning / AI
Ako je alat (backend) sam pravio grešku (npr. timeout prilikom pristupa sistemu), da li su traceback-ovi grešaka prosleđivani modelima?
Da li je u sistemu obavljena provera duplikata u slučaju kvara nakon uspešnog zapisa (idempotentnost)?
Na čemu su merili metrike izbora modela (koji skup podataka)?
Да ли сте тестирали друге embedding моделе?
Na čemu su merene metrike retrive (koji skup podataka i alat)?
Koja je bila veličina čanka i da li je bilo preklapanja?
Zašto u multiagentnom sistemu nije korišćen Human-in-the-Loop, samo u ReAct?
Šta je BERT i na kojim zadacima je treniran?
Opisati ciklus ReAct agenta: koji su bili koraci i kako je završavao ciklus?
Koje vrste označavanja za zadatak NER poznaješ? Čime si radio?
Šta je VLM (Model vizuelnog jezika)?
Što će biti brže u pogledu brzine — običan agent sa alatima ili multiagentni sistem?
U kom delu (BM25 ili dense) vrednosti nisu normalizovane?
Koji je bio toolcalling: nativni ili putem prompta (parsing)?
А ако модел давао неважећи аргумент — шта сте радили?
Да ли сте користили један модел за све агенте или различите?
Kako su modeli prijavili da argument nije validan?
Koja je razlika između fine-tuning i few-shot prompting? Šta i kada izabrati?
Da li je bilo paralelnosti u izvršavanju agenata ili je sve bilo sekvencijalno?