O que é um token OOV e como a subword-tokenização lida com ele?
Machine Learning / AI
Qual é a diferença entre stemming e lematização? Em que tarefas usar cada um?
Como fazer profiling da inferência de LLM na GPU (nsight, torch profiler)?
Quais são os riscos do AutoML do ponto de vista da interpretabilidade?
O que são imagens multiespectrais e hiperespectrais?
O que são multi-armed bandits e onde usá-los em vez de testes A/B?
Sexta-feira, restam 2,5 horas até ao final do dia de trabalho. Chega um cliente de negócios e diz que há uma reunião na segunda-feira às 9h30 e que é preciso terminar uma tarefa que leva 5-6 horas. O que vais fazer?
O que é redação e tokenização de PII em conjuntos de dados?
Perguntas do candidato sobre o formato de trabalho e a equipa.
O que é Medusa e cabeças de previsão multi-token?
O que é MIG (Multi-Instance GPU) no A100/H100?
O que é um token e quais as diferenças entre tokenização a nível de carácter, palavra e subpalavra?
O que é a aproximação de campo médio?
Os dados eram armazenados em forma de tabela plana? Você desenvolveu os recursos sozinho ou alguém fez isso por você?
O que é um ataque direcionado vs não direcionado?
O que é segmentação de objetos de vídeo e rastreamento de máscaras (XMem, SAM2)?
O que é um confounder e como considerá-lo?
Quais os problemas na previsão de séries instáveis (cold start de produtos)?
Qual é a diferença entre recuperação esparsa (BM25) e densa?
O que são meta-aprendizes (S-learner, T-learner, X-learner, R-learner)?