Machine Learning / AI
IPO, KTO, ORPO дегеніміз не, олар DPO-ға балама ретінде қандай?
Бір модельді басқа модельге қалай дистилляциялау керек?
Политика градиенті және саясат градиенті теоремасы дегеніміз не?
Терең оқыту және жасанды интеллектке қалай келдіңіз?
CUDA ағындары және асинхронды орындау дегеніміз не?
Монокуляр тереңдік бағалау дегеніміз не және қандай модельдер бар (MiDaS, Depth Anything)?
Трансформерлердің негізгі тәсілдері мен архитектуралары қандай?
Counterfactual ranking оқыту дегеніміз не?
LLM технологиясы ретінде жұмыс істегенде ескеру маңызды кемінде үш шектеуді атаңыз.
Неліктен осындай әдіс таңдалды (SentenceTransformer + cosine similarity)?
Дыбы деректерін қалай белгілейміз?
Неліктен сыртқы LLM-дерді финтехте өндірістік қызметтерге тікелей қосуға болмайды?
Шешім ағаштары қалай жұмыс істейді және шектеулер болмаған жағдайда не болады?
Қандай ансамбль әдістерін білесіз? Ансамбль әдістерінің қандай топтары бар?
Сіз бұл барлық нәрсені өзіңіз жасадыңыз ба (RAG, LoRA, нейрон желілерімен жұмыс) немесе біреуге көмектестіңіз бе?
Көп агентті жүйенің әрбір төрт агенті қысқаша не істейтіні туралы сипаттаңыз.
Неліктен Layer Norm трансформерлерде қолданылатынын (Batch Norm емес)?
Диалогтар кестесінде 80 миллион хабарламалар бар, ал бағалау жиынтығы үшін аналитикалық сұрау 25 минут алады және кейде сұрақ-жауап жұптарының қайталануларын қайтарады. Алдымен не түзетесіз және неге?
Python және SQL-ге деген біліктілігіңізді қалай бағалайсыз?
AI-пен сұхбаттасуға дайынсыз ба?