Machine Learning / AI
Kā izmantot papildu raksturlielumus funkciju atlasei?
Kas ir Hyperband un Successive Halving?
Kādi ir koku ansambļi?
Kas ir vaicājuma paplašināšana?
Kā uzraudzīt uzņēmējdarbības atribūtu izmaiņas jau ielādētajos datos?
Vai rindas ar NULL JOIN pēc ID tiks savienotas?
Kas ir pseudo-labeling un kādi ir tā riski?
Kā strādāt ar nereprezentatīviem datiem, kad modelis prognozē 10% nokavējumu vietā 1%?
Kas ir FT-Transformer un SAINT tabulām?
Kas ir CBAM (Konvolūcijas bloka uzmanības modulis)?
Kāpēc nedarboties tieši ar sākotnējo datu bāzi?
Kādus optimizētājus jūs zināt (SGD, Momentum, RMSProp, Adam, AdamW)? Kādas ir idejas un atšķirības?
No kurienes tika ņemtas meklēšanas pieprasījumu variants?
Kā skaņas apstrāde var tikt piemērota metriku analīzei?
Kā saskaitīt kolonnas ne null elementu skaitu?
Kā sagatavojāt dokumentus RAG (chunking, embeddings, Milvus) vajadzībām?
Kāda ir atšķirība starp partīciju un sharding?
Kādas metriku vari nosaukt klasifikācijas uzdevumiem? Pastāsti par katru no tām.
No kurienes ir zināms datu daudzums?
Kā četru reizi palielināts partijas lielums ietekmē mācīšanās ātrumu un kāpēc? Kā darbojas atpakaļizplatīšana?