Machine Learning / AI
Praktická úloha Aký súbor artefaktov umožňuje spravodlivé porovnanie dvoch spustení LoRA? - Len konečná tabuľka kvality. - Commit s kódom a snímkou obrazovky konečnej metriky. - Kód a konfiguračný súbor experimentu. - Kód, hash dát, základný model, konfigurácia LoRA, závislosti a príkaz na spustenie. - Len odkaz na vetvu Git. - Kód, parametre LoRA, verzia základného modelu a závislosti.
Ak vynásobíme všetky skóre modelu dvomi, zmení sa ROC AUC?
Čo sa očakáva od produktového analytika pri práci s inými tímami a samostatne?
Čo je normalizácia dĺžky dokumentu?
Povedzte nám o Dropout: ako funguje počas tréningu a čo sa s ním deje pri inferencii?
Ako pomáha dropout predchádzať preučeniu v neurónových sieťach?
Čo je confounder a ako ho zohľadniť?
Čo je NLU a aké sú jeho podúlohy (zámery, sloty, entity)?
Je možné vrátiť akýkoľvek znak pri rovnakom počte po sebe idúcich znakov?
Približne koľko tokenov bolo na jeden prechod end-to-end?
Čo je to jazykový model?
Čo je pivotovaná normalizácia?
Čo je filter bubble a ako ju odhaliť?
Aký bol najťažší týždeň v [spoločnosti]?
Čo je to endpoint v integráciách?
Aké funkcie aktivácie sa používajú v CV (Swish/SiLU, Mish, GELU)?
Čo je supervised fine-tuning (SFT)? Aké údaje sú potrebné?
Použili ste plnotextové vyhľadávanie?
Čo je MTP blok v LLM?
Ako vybrať znaky v modeli? Existuje boosting a 5000 znakov.