Machine Learning / AI
Ako si lineárny model poradí s multikollinearitou znakov?
Aké sú možnosti odberu vzoriek nových tokenov v LLM?
Ako sa trénuje reranker?
Prečo sa náhodný les nazýva náhodný?
Aká dátová štruktúra v Pythone umožňuje modelovať NoSQL databázy?
Ako je plánovaný pracovný čas?
Stále pracujete v spoločnosti (DOM.RF)?
Môžeš jednoducho vysvetliť rozdiel medzi Recall a MRR?
Vypočítajte F1 pre model, ktorý vždy predpovedá 0, na vzorke 90 núl a 10 jednotiek.
Povedz mi o LoRA: čo je, ako sa trénuje a ako funguje pri inferencii?
Imamo oddelek za človeške vire z denarjem in ambicioznimi načrti, išče agenta, ki vnaša zahteve in odgovarja v bazo znanja. Kako bi pristopil k rešitvi tega vprašanja?
Porovnajte lineárne a nelineárne modely v klasickom ML — výhody a nevýhody.
Je ti všetko jasné ohľadom produktu (mediálne plány), alebo chceš niečo upresniť?
Kakšna bo vrednost metrike ROC-AUC za klasifikator, ki vedno daje vrednost 0,9 na podatkovnem naboru, sestavljenem iz 90 pozitivnih in 10 negativnih primerov?
V čom cítite najväčnú istotu, vo svojej odbornosti alebo v znalostiach, s ohľadom na široký súbor zručností?
Ako rozdeliť údaje do skupín pomocou okienkových funkcií v SQL?
Máte malý súbor údajov s recenziami filmov v ruštine a ich binárnym označením sentimentu (značky: 0 — negatívne, 1 — pozitívne). Vašou úlohou je implementovať kompletný pipeline za 15 minút na trénovanie jednoduchého modelu klasifikácie textu bez použitia hotových encoderov ako BERT a zobraziť presnosť (accuracy) na týchto dátach. reviews = [ "Tento film je jednoducho úžasný!", "Hrozné herecké výkony a nudný dej.", "Každú chvíľu som si užil!", "Najhorší film, ktorý som videl.", "Skvelá réžia a úžasný príbeh.", "Neznesiteľne nudný a predvídateľný." ] labels = [1, 0, 1, 0, 1, 0]
Ako hodnotíte svoju úroveň?
Ako implementovať smerovanie požiadaviek medzi scénami — v akom tvare LLM poskytuje odpoveď a ako sa na základe nej vyberie scénar?
Napíšte funkciu v Pythone, ktorá prijíma neusporiadaný zoznam celých čísel a vracia medián.