Machine Learning / AI
O que esquecem de fazer com os dados na CUDA, o que pode levar a um estouro de memória durante o treino?
De que grandes partes é que o agente é composto?
Como construiria uma pipeline de dados e features para a solução discutida?
Ultimamente há muitas redes neurais, como as usas no trabalho, com que frequência e exatamente como?
Por que não se usa a fórmula analítica na resolução de um problema de regressão linear?
Qual sistema operativo e configuração do computador local você usa?
Fale sobre si e a sua experiência como engenheiro de ML.
Qual é o viés e a variância de diferentes tipos de modelos: modelos lineares, árvores, ensembles de árvores?
Calcular o valor total de receita (revenue) para cada utilizador Para cada utilizador, encontrar a sua primeira e última data de compra Adicionar ao DataFrame uma nova coluna prev_revenue, que contém a receita da compra anterior desse mesmo utilizador (deslocamento dentro do grupo). Se não houver anterior, colocar NaN
Tem experiência com séries temporais? Quais métricas são usadas para avaliar a qualidade dos modelos de previsão de séries temporais?
Quais métricas são usadas para avaliar a qualidade do clustering? Como escolher o número de clusters?
O que é tool-calling e que tipos de ferramentas os agentes usam?
O que se faz com os logits antes do sampling e quais os parâmetros de sampling que conheces?
Quais critérios de paragem de crescimento da árvore existem além da limitação de profundidade?
O que é PatchTST?
Fale sobre observabilidade e rastreamento no projeto.
Como implementar a fusão de duas listas usando um ciclo while com listas de tamanhos diferentes?
O que acontece se remover uma árvore de uma floresta aleatória?
Nomeie os métodos clássicos de obtenção de embeddings de palavras (Word2Vec, FastText, TF-IDF, N-gramas, etc.).
O que é regularização?