Machine Learning / AI
¿Qué se enviaba al usuario final en su sistema?
¿Hubo paralelismo en la ejecución de los agentes o todo fue secuencial?
¿Cuál será el valor de la métrica ROC-AUC para un clasificador que siempre da un valor de 0.9 en un conjunto de datos compuesto por 90 ejemplos positivos y 10 negativos?
¿Cómo se entrenan los modelos de incrustación? ¿Cómo escribirías tu propio incrustador?
¿Cómo implementó y desplegó el servicio para procesar pull requests?
Nombra una ventaja y una desventaja de CatBoost en comparación con LightGBM.
¿Cómo calculará la varianza para una muestra de 20 empleados? ¿Y en qué se diferencia su estimación de simplemente usar el número aleatorio 3?
¿Tienes un equipo grande?
¿Estás en Moscú tú solo? ¿Es crítico el momento con la ubicación?
¿Utiliza el estado en LangGraph y pasa todo el estado al contexto?
¿Qué es LoRA (Low-Rank Adaptation)?
¿Cómo recopilaste las métricas de calidad del sistema RAG? ¿Qué métricas utilizaste y qué herramientas?
¿Quién revisó en general tu código, tu trabajo, quién lo verificó?
Cuéntame sobre la tarea de evaluación de la pronunciación: ¿cómo abordar la mejora del modelo que detecta errores en la pronunciación de fonemas y sonidos?
¿Por qué en el sistema multiagente no se utilizó Human-in-the-Loop, solo en ReAct?
¿Qué sucede en la memoria cuando convertimos una cadena a minúsculas con lower()? ¿Qué operación en memoria ocupa?
¿Qué formato de formalización le resulta más conveniente: GPH, IP o TК?
El agente A cerró 7 de 70 clientes potenciales, y el agente B — 2 de 3. ¿Cómo compararlos de manera justa?
Imagina que estás trabajando con un modelo en PyTorch y, después de convertirlo a modo evaluación eval(), ves que las métricas en un conjunto de prueba fijo de 10,000 ejemplos cambian en cada ejecución. Fijas el estado inicial de los generadores de números aleatorios para reproducibilidad: ¿dónde más podría estar oculto el origen de los cambios? Explica el papel de Dropout, BatchNorm y torch.no_grad() y nombra las métricas con umbrales con los que verificarás la estabilidad de los resultados.
Cuéntenos sobre Word2Vec: ¿qué enfoques de entrenamiento se utilizan en él (CBOW, Skip-gram)?