Kā noteikt, vai ievietošanas modelis darbojas labi? Kuras metriku tika izmantotas?
Machine Learning / AI
Vai vari paskaidrot starpību starp cross-encoder un bi-encoder?
Vai ir veids, kā pārbaudīt, vai ģenerētais teksts nesatur faktu kļūdas attiecībā uz oriģinālu?
Kā tika izņemti dati no PDF dokumentiem RAG sistēmai?
Pastāsti man par modeļu kvantizāciju: kas tas ir, kam tas ir nepieciešams, kādi veidi ir?
Kā tika izvēlēta chunking stratēģija RAG sistēmai?
Kā pārbaudīt FastAPI realizēto pakalpojumu?
Pastāsti par ML pakalpojuma veiktspējas metriku: latentāte, RPS, kā tas tika organizēts tavā projektā?
Pastāsti par vektoru datu bāzēm, kādas tās ir, kā atšķiras, kāpēc izvēlējāties pgvector?
Pastāsti par LLM ģenerēšanas parametriem: temperatūra, top-k, top-p un citus.
Kā saistīti Recall un Precision, vai ir iespējams palielināt vienu, nesamazējot otru? Sniedziet uzdevumu piemērus.
Pastāstiet par visgrūtāko uzdevumu vai grūtību kādā no projektiem.
Kā tika organizēti dati dialogu kopsavilkumam un kā notika apmācība?
Kura kvantizācijas metode (int8 vai float) mazāk sabojās modeļa kvalitāti?
Kā novērtēt kopsavilkuma kvalitāti?
Kā tu pieietu uzdevumam apkopt vairāk cilvēku dialogu konferencē (piemēram, 10 izstrādātāji Slack)?
Kuru modeli un pieeju izvēlēties konferences audio apstrādei (speech-to-text, diarization)?
Pastāsti man par LoRA: kas tas ir, kam tas ir nepieciešams?
Kā strādāt ar privātiem datiem sistēmas lokālai izvietošanai?
Kāpēc izvēlējāties hibrīda meklēšanu BM25 + embeddings vietā, lai izmantotu tikai kosinusa attālumu?