¿Qué es un token OOV y cómo lo maneja la subpalabra-tokenización?
Machine Learning / AI
¿En qué se diferencia el stemming de la lematización? ¿En qué tareas se debe aplicar cada uno?
¿Cómo perfilar la inferencia de LLM en GPU (nsight, torch profiler)?
¿Qué son las imágenes multiespectrales e hiperespectrales?
¿Cuáles son los riesgos de AutoML desde el punto de vista de la interpretabilidad?
Viernes, quedan 2.5 horas hasta el final del día laboral. Llega un cliente de negocios y dice que hay una reunión el lunes a las 9:30 y que hay que terminar una tarea que lleva 5-6 horas. ¿Qué harás?
¿Qué son los multi-armed bandits y dónde usarlos en lugar de pruebas A/B?
¿Qué es la redacción y la tokenización de PII en conjuntos de datos?
¿Qué es MIG (Multi-Instance GPU) en A100/H100?
¿Qué es un token y en qué se diferencian la tokenización a nivel de carácter, palabra y subpalabra?
¿Qué es la aproximación de campo medio?
Preguntas del candidato sobre el formato de trabajo y el equipo.
¿Qué es Medusa y las cabezas de predicción de múltiples tokens?
¿Qué son los meta-aprendices (S-learner, T-learner, X-learner, R-learner)?
¿Qué es un ataque dirigido frente a uno no dirigido?
¿Qué problemas surgen al pronosticar series inestables (inicio en frío de productos)?
¿ Los datos se almacenaban en forma de tabla plana? ¿ Tú desarrollaste las funciones tú mismo o alguien más las hizo por ti?
¿Qué técnicas se utilizan para trabajar con datos muy dispersos?
¿En qué se diferencia la recuperación dispersa (BM25) de la densa?
¿Qué es la comprensión de documentos sin OCR (Donut, Pix2Struct)?