Zvažuješ pouze pozici ML inženýra nebo i Data Scientist?
Machine Learning / AI
Jak volá LLM nástroje nebo MCP, pokud je máme?
Jaké potíže vznikají při používání Word2Vec a NLTK pro ruský jazyk?
V tabulce dialogů je 80 milionů zpráv a analytický dotaz pro sadu hodnocení trvá 25 minut a občas vrací duplicitní páry otázka-odpověď. Co byste opravili jako první a proč?
Pro generování otázek má velký jazykový model potíže udržet styl u vzácných témat. AI asistent navrhuje okamžitě spustit LoRA na celém historickém korpusu 2 milionů dialogů, ale označení je částečně šumivé. Kde této radě nedůvěřujete a co byste vybrali jako první?
Jaký je rozdíl mezi požadavky GET a POST?
V čem se obecně liší ChatGPT od asistenta uvnitř firmy (chat-robot vs asistent)?
Pověz mi o svých projektech: co jsi přesně dělal, technicky podrobně?
S jakými nástroji gradient boosting jste pracoval? CatBoost, LightGBM, XGBoost?
Jak přistupovat k zarovnání jednoho slova podle fonémů? Jak používat wav2vec2 k získání přesných hranic fonémů?
Jak řešit problém růstu kontextu při aktivním dialogu s uživatelem?
Jaké jsou hlavní rozdíly mezi strojovým učením a hlubokým učením?
Proč strukturovaný výstup vždy vydává platné JSON? Na jaké úrovni je to realizováno?
Kolik vlastností vezmete z feature store a jak je vyberete, pokud je všech 5000 vlastností platných a bez úniku?
Co vás inspiruje v práci?
Co se stane, když do dekodéru vložíte sekvenci délky 10k tokenů, zatímco model byl trénován na 9k?
Jak byly směrovány mezi agenty? Uveďte příklad podmínek přepínání.
Co se stane s kvalitou modelu, pokud odstraníme první a poslední strom v náhodném lese a v gradientovém boostingu?
Jaká je role Astona v pracovním procesu projektu?
Popište postupně projekt předpovědi odchodu zaměstnanců: obchodní problém, formulace úlohy ML, metriky a data.