Šta treba uraditi nakon retrieval-a da bi se formirao odgovor korisniku i kako oceniti kvalitet generisanja u RAG?
Machine Learning / AI
Kako LLM poziva alate ili MCP ako ih imamo?
Koje poteškoće nastaju pri korišćenju Word2Vec i NLTK za ruski jezik?
U tabeli dijaloga ima 80 miliona poruka, a analitički upit za skup evaluacije traje 25 minuta i ponekad vraća duplikate parova pitanje-odgovor. Šta biste prvo ispravili i zašto?
Za generisanje pitanja, veliki jezički model teško održava stil na retkim temama. AI asistent predlaže odmah pokretanje LoRA na celom istorijskom korpusu od 2 miliona dijaloga, ali oznaka je delimično šumovita. Gde ne biste verovali ovom savetu i šta biste prvo izabrali?
Koja je razlika između GET i POST zahteva?
U čemu se uopšteno razlikuje ChatGPT od asistenta unutar kompanije (čat-bot vs asistent)?
Ispričaj o svojim projektima: šta si tačno radio, tehnički detaljno?
С којим алатима за градиентно бустирање сте радили? CatBoost, LightGBM, XGBoost?
Kako pristupiti usklađivanju jedne reči po fonemima? Kako koristiti wav2vec2 za dobijanje tačnih granica fonema?
Kako se nositi sa problemom rasta konteksta tokom aktivnog dijaloga sa korisnikom?
Koje su glavne razlike između mašinskog učenja i dubokog učenja?
Zašto strukturirani izlaz uvek daje validan JSON? Na kom nivou se to implementira?
Колико карактеристика ћете узети из feature store-а и како ћете их изабрати ако су све 5000 карактеристика валидне и без изливања?
Šta vas inspiriše u radu?
Šta će se desiti ako unesete u dekoder sekvencu dužine 10k tokena, a model je treniran na 9k?
Kako su rutirane između agenata? Dajte primer uslova prebacivanja.
Šta će se desiti sa kvalitetom modela ako uklonimo prvo i poslednje drvo u slučajnoj šumi i u gradijentnom boostingu?
Која је улога Астона у радном току пројекта?
Redom opišite projekat predviđanja odlaska zaposlenih: poslovni problem, definicija ML zadatka, metrike i podaci.