Machine Learning / AI
O que é o estimador de Kaplan-Meier?
O que são modelos de diálogo de ponta a ponta?
Como calcular a mediana usando MapReduce?
CLIP: ideia, função de perda, método de treino, para que é usado. Quais métricas de distância entre embeddings podem ser usadas e quais os autores usaram?
Por que maximizaram o Recall, se ao mesmo tempo dizem que não tentaram cobrir tudo?
O que são métricas de frescura e completude?
Como funciona a luta contra o fraude nas caixas de autoatendimento?
Por que é que se usa a comparação com epsilon na atualização dos pesos?
O que é compreensão de documentos sem OCR (Donut, Pix2Struct)?
Qual é a diferença entre embeddings posicionais absolutos e relativos?
Para que serve uma chave primária?
Quando os métodos clássicos são melhores que ML/DL para previsão de séries?
Como foram organizados os registos e as agregações na janela móvel de três meses para o projeto de churn?
O que significa o nível 10 na escala de proficiência em SQL e Python?
Qual é a ideia por trás da floresta aleatória e por que ela funciona?
Qual é a diferença entre QAT e PTQ?
O que são explicações contrafactuais?
Que problemas surgem ao inicializar os pesos com zeros? Quais métodos de inicialização (Xavier, He) resolvem esses problemas?
Conte-nos sobre projetos interessantes na área de ML clássico — scoring, classificação.
Nome alguns tipos de métricas de classificação e explique-os.