Machine Learning / AI
Какво е HyDE (Hypothetical Document Embeddings)?
Какво трябва да съдържа един обект, за да бъде итератор в Python?
Какво е RoPE (завъртащи се позиционни вграждания) и какви са предимствата му?
Как ефективно да търсите подобни ембедингии сред милиони продукти с помощта на Faiss или други индекси?
Кои модели минимизират bias и кои вариация, сравнявайки boosting и bagging?
Какви методи за клъстеризация на експеримента съществуват (кластерна рандомизация)?
Какво да правите, ако доходът на клиента е неизвестен?
Какви са недостатъците на колоновите бази данни?
Как да решим проблема със сумиране на приходите при голям обем данни?
Какво е RMSNorm и защо се използва в LLaMA?
Какво е MC Dropout като Байесово приближение?
Как влияе броят на дърветата в случаен лес върху качеството на модела?
Дали низовете в Python са променливи или непроменливи?
Каква семантика трябва да отразяват бекендите за идентификация?
Какво е квантизация в машинното обучение? Как се извършва квантизация от FP32 към INT8 — от число с плаваща запетая към цяло число?
Къде е насочен градиентът на функцията f(x) = 4x + 5 в точката x?
Какво е алтернативната релевантност на продуктите в резултатите от търсенето?
Какви са позиционните вграждания и за какво служат? Какви видове (синусоидални, научени, RoPE, ALiBi) има и за какво е всеки?
Обяснете хибридното търсене: защо да комбинирате векторното търсене и BM25? Какво е RRF (Reciprocal Rank Fusion)?
Какво е Snorkel и слабо наблюдение?