¿En qué se diferencia el stemming de la lematización? ¿En qué tareas se debe aplicar cada uno?
Machine Learning / AI
¿Por qué BF16 es más conveniente que FP16 al entrenar modelos grandes?
¿Qué comprobaciones hacer al elegir la tasa de aprendizaje para SFT LLM?
¿Por qué en entornos industriales se utiliza más el refuerzo de gradiente que el bosque aleatorio?
¿Qué es Delta Lake / Iceberg / Hudi y por qué lakehouse?
¿Cuáles son las soluciones AutoML populares (H2O, AutoGluon, FLAML, AutoKeras)?
¿Qué es multimodal RAG y cómo hacer un índice de imágenes?
¿Has trabajado con Apache Spark?
¿Qué es un bounding box y qué formatos de coordenadas existen (xyxy, xywh, cxcywh)?
¿Cuáles son las tendencias modernas en el entrenamiento en clústeres mixtos GPU+CPU+TPU?
¿Qué métodos de detección de anomalías para imágenes (PaDiM, PatchCore)?
¿Qué es LambdaRank?
¿Qué es MCMC y qué métodos (Metropolis-Hastings, Gibbs, HMC)?
¿Qué es OWL-ViT?
¿Qué es ROUGE y en qué se diferencia ROUGE-L de ROUGE-N?
¿Qué es la pérdida de frontera y para qué sirve?
¿Qué tareas consideras ideales y en qué quieres trabajar?
¿Qué son los detectores sin anclajes? Hable sobre FCOS.
¿Qué son las incrustaciones de gráficos de conocimiento (TransE, RotatE, ComplEx)?
¿Qué es el checkpointing asíncrono y cómo funciona?