Zvažuješ len pozíciu ML inžiniera alebo aj Data Scientist?
Machine Learning / AI
Ako volá LLM nástroje alebo MCP, ak ich máme?
Aké ťažkosti vznikajú pri používaní Word2Vec a NLTK pre ruský jazyk?
V tabuľke dialógov je 80 miliónov správ, a analytický dopyt pre hodnotiaci súbor trvá 25 minút a niekedy vracia duplikáty párov otázka-odpoveď. Čo by ste opravili ako prvé a prečo?
Pri generiranju vprašanj ima velik jezikovni model težave pri ohranjanju sloga na redkih temah. AI asistent predlaga takojšnje zagon LoRA na celotnem zgodovinskem korpusu 2 milijona dialogov, vendar je označevanje delno šumovito. Kje mu ne bi zaupali in kaj bi izbrali najprej?
Aký je rozdiel medzi požiadavkami GET a POST?
V čom sa všeobecne líši ChatGPT od asistenta v rámci spoločnosti (chat-bot vs asistent)?
Povedz mi o svojich projektoch: čo si presne robil, technicky podrobne?
S akými nástrojmi gradient boosting ste pracovali? CatBoost, LightGBM, XGBoost?
Ako pristúpiť k zarovnaniu jednej slová podľa foném? Ako použiť wav2vec2 na získanie presných hraníc foném?
Ako riešiť problém rastu kontextu pri aktívnom dialógu s používateľom?
Aké sú hlavné rozdiely medzi strojovým učením a hlbokým učením?
Prečo štruktúrovaný výstup vždy vydáva platný JSON? Na akej úrovni sa to realizuje?
Koľko vlastností vezmete z feature store a ako ich vyberiete, ak všetkých 5000 vlastností je platných a bez únikov?
Čo vás inšpiruje v práci?
Čo sa stane, ak do dekodéra vložíte sekvencu dĺžky 10k tokenov, zatiaľ čo model bol trénovaný na 9k?
Ako boli medzi agentmi smerované? Uveďte príklad podmienok prepínania.
Čo sa stane s kakovostjo modela, če odstranimo prvo in zadnje drevo v naključnem gozdu in v gradientnem boostingu?
Aká je úloha Astona v pracovnom toku projektu?
Postopoma opíšte projekt predikcie odchodu zamestnancov: obchodný problém, formulácia ML úlohy, metriky a údaje.