Machine Learning / AI
Cuéntame la diferencia entre multitarea, multiprocesamiento y asincronía
¿Es más cómodo trabajar por IP o por TК?
¿Cómo evalúa su nivel de dominio de Python y SQL?
Cuéntame sobre las bases de datos con las que has trabajado
Cuéntame, ¿cuál es la composición del equipo, quién suele asignar las tareas y cómo se distribuyen las tareas entre el equipo?
¿Qué métricas existen en PLN?
¿Cómo reduces las alucinaciones en la canalización de extracción de información?
¿Por qué decidiste cambiarte a TI/Ciencia de Datos?
¿Qué son los multi-armed bandits y dónde usarlos en lugar de pruebas A/B?
¿Seleccionan un subconjunto de características en los nodos individuales del árbol o para todo el árbol en su conjunto?
¿Qué métricas son las más prioritarias en un gran desequilibrio de clases (99 a 1)?
¿Por qué el proyecto se desarrolló durante dos años, si dices que lo principal se hizo hace otros dos años? ¿El proyecto está en mantenimiento ahora o se ha desarrollado más?
¿Cómo abordarías la tarea de resumir un diálogo de varias personas en una conferencia (por ejemplo, 10 desarrolladores en Slack)?
¿Qué se registraba en los metadatos de los documentos en el almacenamiento vectorial?
¿Cómo se ve arquitectónicamente el entrenamiento de Word2Vec? ¿Cómo predice el modelo la palabra faltante por el contexto?
¿Qué herramientas se utilizaron durante las pruebas?
¿Qué otros boosting has probado además de CatBoost?
¿Qué es Apache Beam / Dataflow?
¿Qué es Field-aware FM (FFM)?
¿Se pueden tener en cuenta las interacciones previas con el cliente en las métricas de los modelos uplift?