Machine Learning / AI
Ako doladiť BERT pre NER? Aká je strata a tokenizácia označení?
Prečo je pre banku výhodné mať veľké objemy prostriedkov na bežnom účte?
Čo je rozpoznávanie akcií a aké sú populárne dátové súbory (Kinetics, UCF)?
Prosím, povedzte mi o vašich skúsenostiach
Ako overiť, že údaje zo zdroja dorazili do úložiska?
Aké sú alternatívy k grid search pri výbere hyperparametrov?
Prečo sa v reziduálnom spojení používa operácia sčítania, nie konkatenácia?
Aký problém rieši batch-normalizácia?
Ako trénovať LLM, aby neodpovedal, keď v kontexte nie sú žiadne informácie?
Kde sa momentálne nachádzaš teritoriálne a odkiaľ budeš pracovať?
Ako zvyčajne spravujete verzie údajov a modelov v takýchto experimentoch?
Daný je reťazec S. Je takmer palindróm (palindróm po odstránení nie viac ako jedného znaku)?
Ako sa správajú Precision a Recall pri nerovnováhe tried? Príklad: 95 jednotiek a 5 núl, model vždy predpovedá 1.
Čo je judge LLM a aké má problémy s predsudkami (dĺžka predsudkov, pozícia predsudkov)?
Ako zorganizovať aktualizáciu indexu v produkcii bez výpadku?
Ako sa trénujú embeddingy pre úlohu s hard negatives?
Ako vybrať formát kvantizácie pre inference na CPU vs GPU?
Čo je DPO a prečo je populárnejší ako PPO v otvorených modeloch?
Môže byť prázdny zoznam odstránený z pamäte a kedy sa to deje v Pythone?
Aké sú metódy profilovania GPU (nsight, torch.profiler, py-spy)?