Kaip nustatyti, ar įterpimo modelis veikia gerai? Kokius rodiklius naudota?
Machine Learning / AI
Ar galite paaiškinti skirtumą tarp cross-encoder ir bi-encoder?
Ar yra būdas patikrinti, ar sugeneruotas tekstas neapima faktinių klaidų, palyginti su originalu?
Kaip iš PDF dokumentų buvo išgauti duomenys RAG sistemai?
Papaskink apie modelių kvantizaciją: kas tai yra, kam tai reikalinga, kokios rūšys yra?
Kaip buvo pasirinkta chunking strategija RAG sistemai?
Kaip išbandyti FastAPI įgyvendintą paslaugą?
Papaskink apie ML paslaugos našumo matavimus: latencija, RPS, kaip tai buvo organizuota tavo projekte?
Papaskink apie vektorinės duomenų bazes, kurios yra, kuo jos skiriasi, kodėl pasirinkote pgvector?
Papaskink apie LLM generavimo parametrus: temperatūrą, top-k, top-p ir kitus.
Papaskinkite apie sunkiausią užduotį ar sunkumą viename iš projektų.
Kaip buvo organizuoti duomenys dialogų santraukimui ir kaip vyko mokymas?
Kaip susiję Recall ir Precision, ar galima vieną padidinti ne sumažinant kito? Pateikite užduočių pavyzdžių.
Kuri kvantizacijos metodas (int8 arba float) mažiau pakenks modeliui?
Kaip įvertinti santraukos kokybę?
Kaip prieitumėte prie užduoties apibendrinti kelių žmonių dialogą konferencijoje (pavyzdžiui, 10 programuotojų Slack'e)?
Kokį modelį ir požiūrį pasirinkti konferencijos garso apdorojimui (speech-to-text, diarization)?
Papaskink apie LoRA: kas tai, kam skirta?
Kaip dirbti su privačiais duomenimis sistemos vietiniame diegime?
Kodėl pasirinkote hibridinį paiešką BM25 + embeddings vietoj tik kosinusinės atstumo?