¿Por qué la regularización L1 tiende a poner los pesos a cero, mientras que la L2 no? ¿Cómo se deriva esto matemáticamente?
Machine Learning / AI
¿Seleccionan un subconjunto de características en los nodos individuales del árbol o para todo el árbol en su conjunto?
¿Cómo estructurar el trabajo desde la formulación de las tareas?
¿Qué es el análisis de supervivencia y qué datos se necesitan?
¿Implementar un algoritmo de unión de secuencias, por ejemplo, hash join?
Cuéntenos sobre el algoritmo de regresión lineal: cómo funciona, qué se entrena y si hay una solución analítica.
¿Para qué sirve una capa de pooling?
¿Cómo implementar un contador con tiempo de vida para la clave en Redis para la tarea de rechazo automático de llamadas?
¿Qué sucede si aplicamos bagging a algoritmos lineales?
¿Dónde te encuentras territorialmente ahora y desde dónde trabajarás?
¿Cómo comparar los embeddings de consultas y productos para buscar candidatos relevantes?
¿Hay alguna otra restricción en los árboles en Random Forest?
¿Dónde y qué se debe almacenar para garantizar la resistencia a fallos en la tarea de desvío automático de llamadas?
¿Qué tipo de JOIN se usa por defecto al escribir simplemente JOIN?
Cuéntame, en qué proyecto trabajaste en tu último empleo, qué hiciste, cuál fue tu parte?
¿Qué modelos tomamos como base en bagging? ¿Cuál es la profundidad de los árboles?
Cuéntenos sobre Word2Vec: ¿qué enfoques de entrenamiento se utilizan en él (CBOW, Skip-gram)?
¿Cómo se ve arquitectónicamente el entrenamiento de Word2Vec? ¿Cómo predice el modelo la palabra faltante por el contexto?