Machine Learning / AI
Ja vēlamies apstrādāt vairākus failus paralēli, ko labāk izmantot?
Ja laika rindu prognozēšanas uzdevumā mērķī ir nulles vai zemas vērtības, kuru kvalitātes metriku ir labāk izmantot: MAPE, SMAPE vai WAPE?
Kādi ir BERT problēmas teksta ģenerēšanas uzdevumos?
Vai ir dokumentāli apstiprināta kopējā pieredze 3 gadi un 2 mēneši?
Kā izvēlēties rindu ar konkrētu indeksu DataFrame?
Kāpēc dalot nepieciešams pārvērst koordinātu par float?
Kādi ir tipiskie LLM pakalpojuma traucējumi?
Kāpēc modelis halucinē — piemēram, apgalvo, ka neeksistējoša persona pastāv?
Ģenerēšanas kvalitātes metriki (FID, IS, KID, CLIPScore)?
Pastāstiet mums par Text-to-SQL aģentu: arhitektūra, pipeline, tehnoloģijas.
Kā īstenot XGBoost modeļa apmācību ar datiem, kas neietilpst atmiņā?
Kāda datu struktūra īsteno sarakstu Python un kāpēc pievienošanas un dzēšanas operācijas var būt O(1)?
Kas ir mūzikas ģenerēšanas modeļi (MusicGen, MusicLM)?
Kas ir normālformas un kādas tās ir?
Kas ir vaicājuma pārstrāde RAG?
Kas ir laika modelēšana un kam ir nepieciešama laika ieeja?
Kas ir CHRF un kur tas tiek izmanto?
Kāpēc tiešās regresijas uzdevuma risināšanā netiek izmantota analītiskā formula?
Kas ir Tversky zaudējums?
Kā tiek apmācīts SBERT tipa modelis ar triplet loss?