Machine Learning / AI
Cuéntame sobre la tarea de evaluación de la pronunciación: ¿cómo abordar la mejora del modelo que detecta errores en la pronunciación de fonemas y sonidos?
¿Por qué en el sistema multiagente no se utilizó Human-in-the-Loop, solo en ReAct?
(Después de aclarar con el entrevistador) ¿Cómo formular ahora la tarea y el enfoque, teniendo en cuenta que ya hay recomendaciones de items, y que hay que colocar los bloques en la página principal sin duplicar contenido?
¿Qué es la precisión?
Si la ejecución cambió el estado, pero el LLM no lo ve, ¿cómo se actualizan técnicamente el estado y los metadatos?
El agente A cerró 7 de 70 clientes potenciales, y el agente B — 2 de 3. ¿Cómo compararlos de manera justa?
Imagina que estás trabajando con un modelo en PyTorch y, después de convertirlo a modo evaluación eval(), ves que las métricas en un conjunto de prueba fijo de 10,000 ejemplos cambian en cada ejecución. Fijas el estado inicial de los generadores de números aleatorios para reproducibilidad: ¿dónde más podría estar oculto el origen de los cambios? Explica el papel de Dropout, BatchNorm y torch.no_grad() y nombra las métricas con umbrales con los que verificarás la estabilidad de los resultados.
Cuéntenos sobre Word2Vec: ¿qué enfoques de entrenamiento se utilizan en él (CBOW, Skip-gram)?
¿Todo esto lo hacen diferentes agentes o diferentes herramientas de un mismo agente?
¿Cómo afecta esto a su trabajo que tenga diferentes proyectos? ¿Esto afecta su motivación financiera? ¿Tiene bonificaciones por proyectos?
¿Cuándo estará listo para comenzar en el proyecto?
Cuéntame sobre la tarea más difícil o dificultad en uno de los proyectos.
¿Por qué llamar a optimizer.zero_grad() al inicio del ciclo de entrenamiento?
¿En qué se diferencia el ajuste fino de RAG? ¿Obtendremos el mismo resultado?
¿Cuánto tiempo se necesita para comenzar un nuevo proyecto?
¿Cómo pasar un esquema de modelo para salida estructurada a nivel de código?
¿Se puede construir completamente la parte de recuperación solo con un codificador cruzado, sin bi-encoder?
Desde el punto de vista de las tareas analíticas, ¿qué fue? ¿Has enfrentado pruebas A/B? ¿Qué métricas utilizaste?
¿Indicas experiencia con transformadores? ¿Qué exactamente hiciste con la arquitectura de transformadores en RAG?
¿Has tenido contacto con clientes? ¿En qué formato?