¿Qué problemas existen en las pruebas A/B de modelos ML (bucle de retroalimentación de datos de entrenamiento)?
Machine Learning / AI
¿Qué es la clasificación de intenciones y el llenado de ranuras en la búsqueda?
¿Cómo evaluar la calidad de recuperación en RAG (recall@k, hit@k, MRR)?
¿Cuáles son las principales diferencias entre GloVe y word2vec?
¿Cómo organizar la evaluación humana de respuestas LLM en un equipo?
¿Cuáles son las soluciones AutoML populares (H2O, AutoGluon, FLAML, AutoKeras)?
¿Con qué herramienta te gustaba trabajar más?
¿Cuáles son las características del aprendizaje activo en tareas de PLN?
¿Qué es el enfoque BERT-as-a-reranker?
¿Con quién te comunicas con más frecuencia en el trabajo?
Diseñe un sistema de evaluación de la relevancia de los resultados de búsqueda con LLM-judge.
¿Qué es la media de rango recíproco (MRR) y dónde se utiliza en la evaluación de búsquedas?
¿Qué es un agente LLM? ¿En qué se diferencia de un pipeline de prompt-chain?
¿Qué es el batching continuo y en qué se diferencia del batching estático?
¿En qué se diferencian los modelos de lenguaje autorregresivos y enmascarados?