¿Cómo usar BERT en una tarea de QA al estilo SQuAD?
Machine Learning / AI
¿Qué características se utilizan en los modelos clásicos de PLN (TF-IDF, n-gramas, n-gramas de caracteres)?
¿Cómo reducir el tamaño de la caché KV (GQA, MQA, ventana deslizante)?
¿Qué problemas tiene RLHF en la práctica (hackeo de recompensas, colapso de modo)?
¿Qué tareas resuelve Deepgram y qué características tiene su API?
¿Cómo elegir el formato de cuantización para inferencia en CPU vs GPU?
¿Qué es el softmax muestreado y cuál es su ventaja en términos de cálculo?
¿Qué es EfficientDet?
¿En qué se diferencia la recuperación dispersa (BM25) de la densa?
¿Qué hiperparámetros de HNSW son importantes (M, efConstruction, efSearch)?
¿Qué técnicas de inferencia en streaming para STT (atención fragmentada, anticipación)?
Compare la clasificación, la localización y la detección.
¿Cuáles son las características de la detección en video en tiempo real (TensorRT, batch=1)?
¿Qué son los mapas de activación de clase (CAM) y Grad-CAM?
¿Qué son DeepSORT y ByteTrack para el seguimiento de múltiples objetos?