Machine Learning / AI
Pastāstiet divos vārdos par komandu, kurā strādājāt [uzņēmumā].
Kāpēc izvēlējāties hibrīda meklēšanu BM25 + embeddings vietā, lai izmantotu tikai kosinusa attālumu?
Kāpēc transformatorā tiek izmantota Layer Norm, nevis Batch Norm?
Dialogu tabulā ir 80 miljonu ziņojumu, un analītiskais vaicājums vērtēšanas komplektam ilgst 25 minūtes un dažreiz atgriež dublikātu jautājumu-atbilžu pārus. Ko jūs labāk pirmo labotu un kāpēc?
Kāda ir konstantes dispersija?
Kas ir termins 'PropNail/TopNail Optimization', ko jūs izmantojāt?
Kā novērtēt meklēšanas kvalitāti vektoru datu bāzē bez marķējuma?
Kā jūs novērtētu savu Python un SQL zināšanu līmeni?
Pastāstiet par savu pieredzi vienlaikus vadot projektus divās uzņēmumos: kādi tie bija projekti un cik ērti bija process?
Kādas metrikas pastāv NLP?
Kā samazināt halucinācijas informācijas ieguves plūsmā?
Vai viņi izvēlas īpašību apakškopu atsevišķos koka mezglos vai visā kokā kopumā?
Pastāstiet par klasterizācijas projektu ar marķējumu pēc biznesa nozīmīguma.
Kāpēc projekts tika izstrādāts divus gadus, ja tu saki, ka galvenā daļa tika izdarīta pirms diviem gadiem? Vai projekts ir tagad uzturēšanas stadijā vai ir vēl attīstīts?
Kas ir DSSM, vai tu zini?
Kā tu pieietu uzdevumam apkopt vairāk cilvēku dialogu konferencē (piemēram, 10 izstrādātāji Slack)?
Kas ir marķējuma izlīdzināšana attēlu klasifikācijā?
Kādus citus boostingus esat mēģinājis, izņemot CatBoost?
Kā jūs īstenojāt un izvietojāt pakalpojumu pull pieprasījumu apstrādei?
Kas ir Arrow un kur tas tiek izmantots?