¿Qué es el valor p y cómo se utilizan para tomar decisiones en la análisis de pruebas A/B (rechazar o no rechazar la hipótesis nula)?
Data Analyst
Explica con palabras el algoritmo para calcular el producto escalar de dos vectores comprimidos (codificados en RLE) en una sola pasada sin descomprimirlos. ¿Cuál es la complejidad asintótica en tiempo?
¿Se utilizó ML para la selección de características en la tarea de clasificación de automóviles?
Cuéntame sobre tus proyectos más interesantes y por qué quieres desarrollarte en análisis.
D. Valera y las máquinas expendedoras En un centro de negocios, hay 10 máquinas expendedoras externamente idénticas con chocolates. Cada máquina dispensa un chocolate con su propia probabilidad fija, que inicialmente es desconocida y puede variar entre máquinas. Valera, con ganas de conseguir la mayor cantidad de chocolates posible, tiene un presupuesto limitado a 200 tugrik. Cada intento de compra (usar cualquier máquina una vez) cuesta exactamente 1 tugrik — el pago se realiza independientemente de si la máquina dispensa un chocolate o no. Valera, intentando aprender las probabilidades de las máquinas, se encontró con el guardia de seguridad Alexei, quien compartió una información importante. El guardia le dijo que 2/5 de las máquinas tienen probabilidades extraídas de una distribución uniforme en [0.2, 0.3], 2/5 de [0.4, 0.5], y el resto de [0.85, 1]. Tu tarea es diseñar un algoritmo que ayude a Valera a conseguir la mayor cantidad posible de chocolates. Protocolo de interacción Esta es una tarea interactiva. Tu programa debe primero mostrar el número de la máquina — un número del 0 al 9. Luego, el sistema (interactor) devolverá el resultado: 1 si se dispensó un chocolate, o 0 si no. Tu programa puede leer este valor (por ejemplo, mediante input()) para usarlo en cálculos posteriores. Sistema de puntuación En cada prueba, se evaluará el porcentaje de intentos exitosos para obtener chocolates. Si este porcentaje supera el 75%, la prueba se considera pasada. Nota Se recomienda usar Python 3.8 (Handbook DS) como compilador.
¿Funcionaría la solución propuesta para SQLite?
¿Cuál es la complejidad asintótica de la solución propuesta en términos de tiempo y memoria?
Una vez, un becario de fraude en Yandex Ads se unió al equipo. Mientras el grupo de fraude operaba, simulando tráfico en sus sitios mediante visitas de bots, y así recibían dinero por impresiones de anuncios por parte de bots, la tarea del becario era encontrar todos esos sitios fraudulentos con tráfico falso. Curiosamente, todo el tráfico en estos sitios se generaba con sustitución de IP, haciendo que pareciera que un bot visitaba desde la ciudad A, pero en realidad, el dispositivo estaba en un lugar completamente diferente. Pasó mucho tiempo, y el becario intentó cubrir a todo este grupo de fraude, incluso logrando atrapar algunos sitios en partes. Pero no se pudo atrapar toda la red. Después de un tiempo, notó una noticia: en la ciudad A, el 02.08.2025, no había internet móvil en absoluto. Sin embargo, el internet cableado (doméstico) seguía funcionando. Dado esto, ¿cómo puede el becario encontrar todos los sitios falsos? Tienes registros de sitios en formato tabla para el período del 30.07.2025 al 10.08.2025: timestamp | site_id | city_id Cada registro corresponde a una visita a un sitio por un dispositivo. Se sabe que el tráfico de bots cambia mucho menos que el tráfico real por día. Tu tarea es encontrar todos los sitios cuyo tráfico consistió principalmente en bots que falsificaron su región a la ciudad A. Nota La tabla que contiene los datos se llama logs. Ejemplo de un registro de tabla: timestamp | site_id | city_id [phone]:13:53 | 6e84d9b71ca44aea | A
¿Por qué sigue teniendo sentido estandarizar el formato de respuesta en el benchmark, incluso si limita al modelo?
¿Se puede resolver Product of Array Except Self de manera más sencilla si se permite usar cualquier operación?
¿Cuál es la complejidad de memoria de la solución al problema Product of Array Except Self y qué variables adicionales se utilizan?
-- 1.2 ¿Cómo cambiará la respuesta si se cambia el tipo de JOIN a LEFT? -- 1.3 Indique el orden de ejecución de los operadores en esta consulta. from join group by select order by limit -- 2. La tabla campaigns fue corregida: se eliminó la duplicación, se añadió la clave (PK). -- Se realizaron más campañas, debido a errores, los usuarios comenzaron a tener intentos fallidos de entrega de comunicaciones, y a algunos ni siquiera se les pudo mostrar. -- Sobre las campañas promocionales enviadas a los usuarios: -- 2.1 Escriba una consulta que muestre la cantidad de usuarios que recibieron con éxito la comunicación para cada campaña. -- 2.2 Modifique la consulta para mostrar: la cantidad de usuarios que no recibieron ninguna comunicación exitosa en total, para cada campaña.
¿Cómo comparar la respuesta del modelo con la referencia (verdad de terreno) en un benchmark? ¿Qué métrica usar?
A. El Mejor Laboratorio Científico En una cierta ciudad, varios laboratorios científicos investigan cultivos bacterianos. Estudian una secuencia de muestras, donde cada muestra pertenece a una cepa específica (tipo de bacteria). La universidad principal de investigación biológica anunció un concurso: encontrar la cantidad máxima de muestras consecutivas que se pueden analizar considerando la restricción. Es decir: en cualquier segmento continuo de la secuencia, no debe haber más de K cepas diferentes. Nuestro laboratorio aspira a ser el mejor de la ciudad. Para ganar el concurso, necesitamos encontrar exactamente esa longitud máxima de segmento que cumple con la condición estricta. Contamos contigo, ya que en caso de victoria, el laboratorio recibirá una subvención que abrirá nuevos horizontes para nuestra investigación. Formato de entrada La primera línea contiene dos números: N — la longitud de la secuencia de muestras y K — la restricción en la cantidad de cepas diferentes. La segunda línea contiene N números — los elementos de la secuencia. Formato de salida El programa debe mostrar el número de la longitud máxima de un segmento de la secuencia de muestras. Ejemplo 1 Entrada [phone] Salida 3
Escriba una función completa sum_series en Python y pruébela con el ejemplo de la tarea.
Para una lista de números enteros, devolver una lista del mismo tamaño, donde en la posición i-ésima está el producto de todos los elementos de la lista, excepto el elemento en la posición i de la lista original Ejemplos: [2, 3, 4] -> [3*4, 2*4, 2*3] -> [12, 8, 6] def product_except_self(nums: list[int]) -> list[int]: # tu código aquí
¿Qué tan interesado estás en el aprendizaje automático y te gustaría aplicarlo en tu trabajo como una herramienta?
¿Puede contar qué pila tecnológica y qué herramientas ha utilizado y logrado dominar?
¿Qué cambiará si reemplazas COUNT(*) por COUNT() sin argumentos?
¿Cómo crearías un benchmark de geometría? Describe la cadena desde la idea hasta el conjunto de datos final.