Machine Learning / AI
¿Qué es llama.cpp y qué formato es GGUF?
¿En qué se diferencia PR-AUC de ROC-AUC?
¿Por qué hay varias cabezas de atención en el transformador? ¿Qué aprenden en la práctica?
¿Por qué es necesario el aumento de datos?
¿Qué es NGBoost y las predicciones probabilísticas?
¿Qué es Hyperband y Successive Halving?
¿Qué es la evaluación de contexto largo? ¿Qué es la aguja en un pajar?
¿Cómo aumentar la cantidad de datos para el entrenamiento con un número reducido de objetos etiquetados?
¿Qué es la calibración y por qué es importante para la equidad?
¿Qué es el modelo de clics (cascade, DBN, UBM)?
¿Cómo formó el conjunto de datos de prueba: de esas mismas 12,000 pares o de nuevos datos?
¿Cómo determinar si una tarea es clasificación, regresión o coincidencia?
¿Qué hiperparámetros de HNSW son importantes (M, efConstruction, efSearch)?
¿Qué es el aprendizaje sin supervisión y qué modelos se utilizan?
¿Qué te parece este esquema de trabajo (outstaff a través de Aston en el proyecto VTB)?
¿Qué es LLaVA y cómo funciona?
Diseña un sistema de envío de notificaciones: arquitectura y descripción detallada del papel de cada servicio.
¿Cómo evaluar la calidad del recuperador? ¿De dónde obtener una colección de documentos para evaluar las métricas?
¿Qué es la significancia estadística y cómo se calcula el valor p?
Háblenos sobre el aislamiento y la seguridad de los agentes.