Machine Learning / AI
¿Qué son los cálculos perezosos en Spark?
¿Qué son la muestreo de Thompson y UCB?
¿Cómo tomar la decisión sobre la función de pérdida para un modelo desde la perspectiva del negocio y los datos?
¿Qué es OSM y cómo extraer etiquetas de él?
¿Cómo aumentar la velocidad en la prueba sin volver a entrenar el modelo?
¿Qué es la cuantificación en el aprendizaje automático? ¿Cómo se realiza la cuantificación de FP32 a INT8 — de un número de punto flotante a un entero?
¿Qué es NSP (predicción de la siguiente oración) y por qué RoBERTa la abandonó?
¿Cuál es la diferencia entre las métricas NDCG y Accuracy? ¿Cuál es más importante para la sección de noticias?
¿Cómo hacer la binarización de factores, por ejemplo, la edad?
¿Qué métodos se pueden utilizar para la generación de imágenes (GAN, VAE, difusionales, autorregresivos)? Ventajas y desventajas de cada uno.
¿En qué se diferencia el muestreo top-k del muestreo top-p (núcleo)?
¿Cómo debe un agente trabajar con un esquema de herramientas muy grande (selección de funciones)?
¿Qué es NGBoost y las predicciones probabilísticas?
¿Qué es una capa de cuello de botella y para qué se utiliza?
¿Qué es CUPED y cómo reduce la varianza?
¿Cuáles son las trampas al usar AutoML en producción (reproducibilidad)?
¿Qué es DeepSpeed ZeRO Stage 1, 2, 3?
¿Qué son los errores de tipo I y II?
¿Alguna vez ha enfrentado un desplazamiento de datos?
¿Qué es el patrón ReAct (Razón + Actuar)?