Можеш ли да објасниш разлику између cross-encoder и bi-encoder?
Machine Learning / AI
Postoji li način da proverite da li generisani tekst ne sadrži faktualne greške u odnosu na original?
Kako odrediti da li model embedovanja dobro funkcioniše? Koje metrike su korišćene?
Kako je odabrana strategija chunkovanja (chunking) za RAG sistem?
Kako testirati implementiranu uslugu na FastAPI?
Kako su podaci iz PDF dokumenata izdvojeni za RAG sistem?
Ispričaj mi o metriki performansi ML usluge: latencija, RPS, kako je to bilo organizovano u tvom projektu?
Реци ми о параметрима генерације LLM: температура, топ-к, топ-п и други.
Ispričaj mi o vektorskim bazama podataka, koje postoje, po čemu se razlikuju, zašto ste odabrali pgvector?
Ispričaj mi o kvantizaciji modela: što je to, čemu služi, koje vrste postoje?
Kako su Recall i Precision povezani, да ли је могуће повећати једно без смањивања другог? Наведите примере задатака.
Kako su organizovani podaci za sažimanje dijaloga i kako je tekao trening?
Koja metoda kvantizacije (int8 ili float) će manje narušiti kvalitet modela?
Kako proceniti kvalitet sumiranja?
Kako bi pristupio zadatku sažimanja dijaloga više ljudi sa konferencije (npr. 10 developera na Slacku)?
Ispričaj mi o najtežem zadatku ili teškoći u jednom od projekata.
Ispričaj mi o LoRA: šta je to, čemu služi?
Koji model i pristup odabrati za obradu audio snimka sa konferencije (speech-to-text, diarizacija)?
Kako raditi sa privatnim podacima tokom lokalnog implementiranja sistema?
Zašto ste odabrali hibridno pretraživanje BM25 + embeddings umesto samo kosinusne udaljenosti?