Machine Learning / AI
Защо тогава ще се обучава ранкерът? Тоест, той ще бъде независим от съдържанието — каква е неговата цел?
Разкажете за Batch Normalization: какво е и защо е необходимо?
Практическо задание AI предлага да обучи LoRA върху всички 2 милиона неочистени диалога. Кой е най-зрелият отговор на кандидата? - Да се доверим на AI: голям корпус ще компенсира грешките. - Първо да променим промта, без да променяме данните. - Да обучим LoRA върху почистената част и да я сравним с базовия модел. - Да проверим случайна извадка от маркировките преди обучението. - Първо да проверим данните и качеството по теми на отделен набор, след което да ограничено обучаваме LoRA. - Да обучим върху целия корпус, но да намалим ранга на LoRA.
Как в Linux да изведете информация за това колко видеопамет заема всеки процес?
Кога дойде в 1C:Rarus? Имаше ли ментор или наставник, който ти помогна да се потопиш в задачите?
Обяснете разликата между обучение с учител и без учител. Моля, отговорете устно на този въпрос.
Има хипотеза, че полът на генералния директор на компанията влияе върху размера на оттока на клиентите от големия бизнес. Как ще търсиш тези данни?
Какъв беше крайният обем на извадката и колко първоначални и избрани признака имаше в проекта?
Разкажете как е устроен RAG pipeline като цяло: кои етапи включва?
Ниво на английски?
Какъв е текущият ти статус на търсене на работа — имаш ли финални оферти, на какъв етап си?
Разкажи за основната архитектура на трансформатора, какви са основните части.
Как разделяме данните за кръстосана проверка?
Разкажете за TF-IDF: как работи, как изглежда крайната матрица?
Какво е важно за вас при избора на ново работно място? Задачи или работа в продуктен екип?
Какво означава за теб отличен или добър екип?
Как се справиха с големия контекст при работа с документи?
Как измерихте качеството на извличането на данни?
Какви метрики бяха използвани за оценка на RAG системата и как беше взето решението за внедряването й в продукция?
Как да запазя в състоянието на LangGraph голямо количество информация, получена чрез API, да я използвам вътре в инструмента, но без да предавам излишни данни в контекста на LLM? Например, LLM вижда само ID и имената на специалистите, докато инструментът получава техния график и допълнителни данни.