¿Qué es la longitud del contexto y por qué es difícil ampliarla?
Machine Learning / AI
¿Qué técnicas de compresión de prompts conoces (LLMLingua)?
¿Qué es el sobreajuste y cómo combatirlo?
¿Cuáles son las causas del sobreajuste?
¿Qué métodos se pueden utilizar para mejorar el modelo?
¿Qué es la autocorrelación y la autocorrelación parcial (ACF, PACF)?
¿Cómo evaluar el tiempo de respuesta mediano del servicio cuando hay un gran volumen de registros que no caben en la memoria?
¿Cómo elegir los datos para estimar la mediana: un recorrido secuencial o una submuestra aleatoria?
¿Qué tipos de regularización existen y cómo funcionan?
¿Qué es un buffer de reproducción de experiencia y para qué sirve?
¿Por qué los pesos del modelo pueden volverse grandes y por qué es necesario reducirlos mediante regularización?
¿Qué es la calibración y por qué es importante para la equidad?
¿Qué es la visualización del espacio de características de un modelo CV con t-SNE/UMAP?
¿Cómo organizar la contenerización y el despliegue de modelos?
¿Qué es Medusa y las cabezas de predicción de múltiples tokens?
¿Qué es NCCL y de qué se encarga?
¿Qué tipos de errores existen en los protocolos médicos y cómo se clasifican?
Diseñe un sistema de OCR + NLP para procesar escaneos de contratos.
¿Cómo probar un agente LLM (pruebas deterministas, reproducción, herramientas simuladas)?
¿Cómo está estructurada la solución al problema de buscar un par de números con una suma dada?