Machine Learning / AI
Тауарлардың танымалдығын жиі ұсыну мәселесін қалай шешуге болады?
import pandas as pd import numpy as np data = { 'user_id': [1, 1, 1, 2, 2, 3, 3, 3, 4], 'date': ['[phone]', '[phone]', '[phone]', '[phone]', '[phone]', '[phone]', '[phone]', '[phone]', '[phone]'], 'revenue': [100, 200, 150, 300, 250, 100, 100, 100, 400] } df = pd.DataFrame(data) df['date'] = pd.to_datetime(df['date']) Әр пайдаланушы үшін жалпы кірісті есептеңіз.
Өндірісте қандай әділдік метрикаларын ескердіңіз?
Ағаштың өсуін тоқтату критерийлері қандай, тереңдік шектеуінен басқа?
МЛ-дің inference энергия тұтынуын қалай профилирлеуге болады?
BERT архитектурасы туралы және ол қалай оқытылғаны туралы айта аласыз ба?
Тексеру кезінде batch normalization статистикасын жаңартса, қандай мәселелер туындайды?
Диалогтар әртүрлі ұзындықта болды — сіз оны қалай басқардыңыз? Барлық әңгімелер контекстік терезеге сыйды ма?
Қолдау билетін жіктеу жүйесінің орналастыруға дайын екендігін қалай бағалайсыз?
Реранкердің шығуы не?
RAG-те гибридті іздеу туралы айтыңыз — тығыз векторлар үшін қандай модель таңдадыңыз?
Тестілеу туралы айтыңыз (шаң, функционалды, e2e)
Неліктен модельдің салмақтары үлкен болуы мүмкін және оларды тұрақтандыру үшін не үшін азайту керек?
GraphRAG вектор RAG-тан қалай ерекшеленеді?
Объектілерді сегментациялау және анықтау үшін қандай метрикалар пайдаланылады?
Қазіргі уақытта басқа ұсыныстарды қарастыруыңыздың себебі неде және жұмыс орнын өзгерту ойыңыз қайда?
Қайсысы жылдамырақ: count(*) немесе count(баған_аты)?
Бенчмарклерде мультимодальды модельдерді салыстырғанда қандай қиындықтар бар?
Құжат ұзындығын нормалау дегеніміз не?
Векторлық базада metadata фильтрлерін қалай пайдалану керек?