O que é o valor p e como fazer conclusões com base nele ao calcular um teste A/B (rejeitar ou não rejeitar a hipótese nula)?
Data Analyst
Explique com palavras o algoritmo para calcular o produto escalar de dois vetores comprimidos (codificados em RLE) numa única passagem sem descompactá-los. Qual é a complexidade assintótica em tempo?
Foi utilizado ML para seleção de características na tarefa de classificação de automóveis?
Fala sobre os teus projetos mais interessantes e por que queres evoluir na análise.
A solução proposta funcionaria para SQLite?
Era uma vez, um estagiário de fraude do Yandex Ads que se juntou à equipa. Enquanto o grupo de fraude operava, simulando tráfego nos seus sites através de visitas de bots, e assim recebendo dinheiro por impressões de anúncios por bots, a tarefa do estagiário era encontrar todos esses sites fraudulentos com tráfego falso. Curiosamente, todo o tráfego nesses sites era gerado com substituição de IP, fazendo parecer que um bot visitava a partir da cidade A, mas na realidade, o dispositivo estava em um local completamente diferente. Passou muito tempo, e o estagiário tentou cobrir todo esse grupo de fraude, conseguindo até apanhar alguns sites em partes. Mas não foi possível apanhar toda a rede. Depois de algum tempo, ele notou uma notícia: na cidade A, em 02.08.2025, não havia internet móvel de forma alguma. No entanto, a internet com fio (doméstica) continuava a funcionar. Dado isto, como pode o estagiário encontrar todos os sites falsos? Temos logs de sites em formato tabela para o período de 30.07.2025 a 10.08.2025: timestamp | site_id | city_id Cada registo corresponde a uma visita a um site por um dispositivo. Sabe-se que o tráfego de bots muda muito menos do que o tráfego real por dia. A sua tarefa é encontrar todos os sites cujo tráfego consistiu principalmente de bots que falsificaram a sua região para a cidade A. Nota A tabela que contém os dados chama-se logs. Exemplo de um registo de tabela: timestamp | site_id | city_id [phone]:13:53 | 6e84d9b71ca44aea | A
D. Valera e máquinas de venda automática Num centro de negócios, existem 10 máquinas de venda automática externamente idênticas com chocolates. Cada máquina dispensa um chocolate com a sua própria probabilidade fixa, que inicialmente é desconhecida e pode variar entre máquinas. Valera quer obter o maior número possível de chocolates, mas o seu orçamento está limitado a 200 tugrik. Cada tentativa de compra (usar qualquer máquina uma vez) custa exatamente 1 tugrik — o pagamento é feito independentemente de a máquina dispensar ou não um chocolate. Valera, tentando aprender as probabilidades das máquinas, encontrou o guarda de segurança Alexei, que partilhou uma informação importante. O guarda disse-lhe que 2/5 das máquinas têm probabilidades retiradas de uma distribuição uniforme em [0.2, 0.3], 2/5 de [0.4, 0.5], e o resto de [0.85, 1]. A sua tarefa é criar um algoritmo que ajude Valera a obter o maior número possível de chocolates. Protocolo de interação Esta é uma tarefa interativa. O seu programa deve primeiro mostrar o número da máquina — um número de 0 a 9. Depois, o sistema (interator) devolverá o resultado: 1 se um chocolate foi dispensado, ou 0 se não. O seu programa pode ler este valor (por exemplo, via input()) para usá-lo em cálculos posteriores. Sistema de pontuação Em cada teste, a percentagem de tentativas bem-sucedidas de obter chocolates será avaliada. Se essa percentagem exceder 75%, o teste é considerado passado. Nota Recomenda-se usar Python 3.8 (Handbook DS) como compilador.
Qual é a complexidade assintótica da solução proposta em termos de tempo e memória?
É possível resolver Product of Array Except Self de forma mais simples se for permitido usar qualquer operação?
Por que ainda faz sentido padronizar o formato de resposta no benchmark, mesmo que limite o modelo?
-- 1.2 Como a resposta mudará se trocar o tipo de JOIN por LEFT? -- 1.3 Indique a ordem de execução dos operadores nesta consulta. from join group by select order by limit -- 2. A tabela campaigns foi corrigida: removido o duplicado, adicionado a chave (PK). -- Foram realizadas mais campanhas, devido a bugs, os usuários começaram a ter tentativas malsucedidas de entrega de comunicações, e alguns nem conseguiram mostrar. -- Sobre as campanhas promocionais enviadas aos usuários: -- 2.1 Escreva uma consulta que mostra o número de usuários que receberam com sucesso a comunicação para cada campanha. -- 2.2 Modifique a consulta para mostrar: o número de usuários que não receberam nenhuma comunicação bem-sucedida, para cada campanha.
A. A Melhor Laboratório Científico Numa certa cidade, vários laboratórios científicos estão a investigar culturas bacterianas. Estudam uma sequência de amostras, onde cada amostra pertence a uma estirpe específica (tipo de bactéria). A universidade principal de investigação biológica anunciou um concurso: encontrar o máximo número de amostras consecutivas que podem ser analisadas considerando a restrição. Especificamente: em qualquer segmento contínuo da sequência, não deve haver mais do que K estirpes diferentes. O nosso laboratório aspira a tornar-se o melhor da cidade. Para vencer o concurso, precisamos de encontrar exatamente esse comprimento máximo de segmento que satisfaz a condição estrita. Contamos consigo, pois em caso de vitória, o laboratório receberá uma subvenção que abrirá novos horizontes para a nossa investigação. Formato de entrada A primeira linha contém dois números: N — o comprimento da sequência de amostras e K — a restrição ao número de estirpes diferentes. A segunda linha contém N números — os elementos da sequência. Formato de saída O programa deve mostrar o número do comprimento máximo de um segmento da sequência de amostras. Exemplo 1 Entrada [phone] Saída 3
Qual é a complexidade de memória da solução do problema Product of Array Except Self e que variáveis adicionais são usadas?
Como comparar a resposta do modelo com a referência (verdade de terreno) em um benchmark? Que métrica usar?
Para uma lista de números inteiros, devolver uma lista do mesmo tamanho, onde na posição i-ésima está o produto de todos os elementos da lista, exceto o elemento na posição i da lista original Exemplos: [2, 3, 4] -> [3*4, 2*4, 2*3] -> [12, 8, 6] def product_except_self(nums: list[int]) -> list[int]: # seu código aqui
Pode contar qual foi a pilha de tecnologia e as ferramentas que utilizou e conseguiu dominar?
Escreva uma função completa sum_series em Python e teste-a com o exemplo do problema.
O que vai mudar se substituir COUNT(*) por COUNT() sem argumento?
Quão interessado você está em aprendizagem automática e gostaria de aplicá-la no seu trabalho como uma ferramenta?
Como criarias um benchmark de geometria? Descreve a cadeia desde a ideia até ao conjunto de dados final.