Ako určiť, či model embeddingov funguje dobre? Aké metriky boli použité?
Machine Learning / AI
Môžeš vysvetliť rozdiel medzi cross-encoder a bi-encoder?
Existuje spôsob, ako overiť, že generovaný text neobsahuje faktické chyby v porovnaní s originálom?
Povedaj mi o kvantizaciji modelov: čo je to, na čo je to, aké druhy existujú?
Ako boli údaje z PDF dokumentov extrahované pre systém RAG?
Ako otestovať implementovanú službu na FastAPI?
Ako bola zvolená stratégia chunkovania pre systém RAG?
Povedaj mi o metrikah zmogljivosti ML storitve: latenca, RPS, kako je bilo to organizirano v tvojem projektu?
Porozprávaj mi o vektorových databázach, aké existujú, v čom sa líšia, prečo ste si vybrali pgvector?
Povedz mi o parametroch generácie LLM: teplota, top-k, top-p a ďalšie.
Ako súvisia Recall a Precision, je možné zvýšiť jedno bez znižovania druhého? Uveďte príklady úloh.
Porozprávaj mi o najťažšej úlohe alebo ťažkosti v jednom z projektov.
Ako hodnotiť kvalitu zhrnutia?
Ako boli údaje organizované pre zhrnutie dialógov a ako prebiehalo školenie?
Ktorá metóda kvantizácie (int8 alebo float) poškodí kvalitu modelu menej?
Ako by ste pristúpili k úlohe zhrnutia dialógu viacerých ľudí z konferencie (napríklad 10 vývojárov na Slacku)?
Aký model a prístup zvoliť pre spracovanie audia z konferencie (speech-to-text, diarizácia)?
Povedz mi o LoRA: čo je to, na čo to je?
Ako pracovať s súkromnými údajmi pri lokálnom nasadení systému?
Prečo ste zvolili hybridné vyhľadávanie BM25 + embeddings namiesto len kosínusovej vzdialenosti?