Sobes.tech

Machine Learning / AI

¿Cómo evaluar la calidad del recuperador? ¿De dónde obtener una colección de documentos para evaluar las métricas?

369

¿Tiene un pequeño conjunto de datos con reseñas de películas en ruso y su etiqueta binaria de sentimiento (etiquetas: 0 — negativo, 1 — positivo)? Su tarea es implementar un pipeline completo en 15 minutos para entrenar un modelo simple de clasificación de texto sin usar codificadores preentrenados como BERT, y mostrar la precisión (accuracy) en estos datos. reviews = [ "¡Esta película es simplemente increíble!", "Actuaciones horribles y trama aburrida.", "¡Me encantó cada momento!", "La peor película que he visto.", "Excelente trabajo de dirección y una historia maravillosa.", "Insportablemente aburrido y predecible." ] labels = [1, 0, 1, 0, 1, 0]

183

¿Qué parámetro en el modelo de incrustación determina la cantidad máxima de tokens en la entrada? ¿Qué sucede si se ingresan más tokens que el límite?

168

¿Cómo afecta un aumento de 4 veces en el tamaño del lote al tasa de aprendizaje y por qué? ¿Cómo funciona la retropropagación?

163

¿Cómo se extraen los datos de la base vectorial mediante una consulta del usuario?

153

¿Qué es la cuantificación del modelo y qué sucede con los pesos al aplicarla en vLLM?

153

¿Qué sucederá si se proporciona un contexto de 120,000 tokens en un LLM con un límite de 60,000?

151

¿Cómo se organizó la búsqueda de información en la base vectorial? ¿Por qué se utilizó Qdrant?

141

¿Qué es LangGraph, para qué se utiliza, cómo se implementan las bifurcaciones y los saltos condicionales? ¿En qué se diferencian las herramientas de los nodos?

140