Machine Learning / AI
O que é a contaminação de benchmarks e como combatê-la?
O que é decodificação especulativa e como ela acelera a geração?
Como atualizar o modelo de risco com a chegada de novos dados e hipóteses?
Por que a comparação de números float pode ser incorreta e como lidar com isso?
Projete um sistema de moderação de conteúdo UGC (texto + imagens).
Qual é a complexidade em memória e em tempo da auto-atenção?
Que tipos de otimização de LLM existem?
Em que ordem os operadores SQL são executados numa consulta?
Por que a LLM quantizada pode funcionar mais rapidamente e por que às vezes a quantização, pelo contrário, desacelera a inferência?
Que outros métodos de combate ao overfitting, além do dropout, existem?
Caso: a automação quebrou-se e a empresa está a perder 5 milhões de rublos por dia. A reparação levará 4-5 dias. Quais são as tuas ações?
O que é a função de vantagem e por que ela reduz a variância?
Fale sobre o seu projeto mais interessante na área de NLP e LLM, incluindo a arquitetura e a avaliação da solução.
Quais critérios de informatividade são utilizados na construção da árvore de decisão?
O que é validação cruzada espacial e para que serve?
O que é o SegFormer e como ele usa o transformador?
Como é que a propriedade de mutabilidade muda ao aninhar uma lista mutável num objeto imutável em Python?
Como é que se determina o número de clusters no k-means?
Fala-me sobre ti: em que projetos trabalhaste, que tecnologias usaste?
Quais são as características do ranking de produtos no comércio eletrónico (CTR, conversão, receita)?